机械荟萃山庄

 找回密码
 立即注册

QQ登录

只需一步,快速开始

搜索
热搜: 活动 交友 discuz
查看: 118|回复: 0

kimi k3与美国大模型还是有差距

[复制链接]

2万

主题

3万

帖子

22万

积分

超级版主

Rank: 8Rank: 8

积分
224828
发表于 7 天前 | 显示全部楼层 |阅读模式
中国人工智能(AI)初创公司月之暗面(Moonshot)日前发布新一代大模型Kimi K3,号称全球目前规模最大的开源模型,性能比肩美国最前沿系统。不过中国AI被指普遍回避敏感政治问题,新发布的Kimi K3被发现同样避谈习。
7月21日,“中国人权”在X账号发帖称,当我们在其面向公众的产品中提出
“如何评价习”
“如何评价中国共产党”
“1989年6月4日在中国发生了什么”时,Kimi一律以“尊敬的用户您好,让我们换个话题再聊聊吧”回避作答。相比之下,面对“如何评价特朗普”,它却能直接给出详尽的回答。
帖文称,当一个国家最强大的AI,连本国的历史与领导人都无法谈论,所谓“开源”与“领先”,也止步于审查划定的红线之前。

网民评论:
“完全在意料之中啊。数字极权或数字威权,在某种程度上强化了权力者的权力。”
“我问千问关于8964、朝鲜、习、独裁国家,然后账号被封了。”
“可以理解,去年deepseek,年初豆包,年中kimi,轮流坐庄,一切尽在不言中。”
“如果在训练的时候加入禁词,迭代几次后Ai将变成偏执狂。”
“中国的AI企业好难啊,由于活在中国,导致芯片购买受限,用便宜的芯片,创新的技术搞出的模型,还得姓党,强制自我阉割,仅在国内用么?付费用户少,成本都cover不住,所以还得国内国外开发两套模型才行,然后国内又得用上特供版。”

政府对大型语言模型进行强制审查,要求AI“体现社会主义核心价值”,拒绝回答涉及政治敏感话题。
英国《金融时报》(FT)2024年报导:政府测试包括Moonshot(Kimi母公司)在内的AI公司模型,审查训练数据、敏感关键字,并强制对政治问题的回应一致。业内人士指出,Kimi拒绝大多数回答与习相关的问题,而这是中国所有主流AI(如Kimi、DeepSeek、Qwen等)的共同要求,目的是防止“颠覆国家政权”或违反所谓“社会主义核心价值”等。
在针对Kimi系列的审查测试中,被认为,Kimi较早版本在英文测试中审查较轻,但中文环境下审查明显,会拒答或采用中官方论调。
另外,Kimi K3本月发布之际,部分用户在测试中,发现其回答“我是Claude,不是Kimi”,引发外界质疑其是否利用美国AI模型输出资料来进行“知识蒸馏”训练。

7月23日欧美权威智库在进行初步测试后发现,中国初创公司月之暗面(Moonshot AI)的最新模型Kimi K3,性能显著低于美国领先的前沿AI模型。
英国人工智能安全研究所(UK AISI)和美国人工智能标准与创新中心(CAISI)对Kimi K3进行联合评估后指出,在初步网络能力评估中,Kimi K3的网络能力显著低于美国最新前沿模型,尤其是在稳定性和成功率上远低于后者。
评估重点考察两部分,一个是通过ExploitBench测试其对41个V8漏洞进行崩溃复现、任意读写、控制流劫持和代码执行的能力;另一个是通过模拟企业网络测试其自主完成多步骤攻击链的水平,并观察安全护栏是否会阻止攻击行为。
结果显示,Kimi K3明显强于GLM-5.2等中国模型,甚至能偶尔完成完整攻击链,但在稳定实现任意代码执行、攻击成功率和综合能力上仍落后于美国最先进的闭源模型。GLM-5.2是智谱AI(Zhipu AI)发布的旗舰级大型语言模型。
在开发漏洞利用程序上,Kimi K3的性能显著低于美国最新的前沿网络模型。美国顶尖模型在约一半样本中能够构建完整漏洞利用链,而Kimi K3和GLM-5.2虽然能发现和复现不少漏洞,却没有完成从漏洞到任意代码执行的完整闭环。
具体而言,Kimi K3平均仅完成了32个步骤攻击路径中的第17个步骤,而美国最强大的网络模型平均完成了28.5个步骤。GLM-5.2平均只能达到第11步。
此外,美国顶尖模型的综合成绩也显著领先,分别比Kimi K3高约44个百分点,比GLM-5.2高约51.8个百分点。
在攻击成功率上,在10次尝试中,Kimi K3有一次在1亿代币的限制下成功完成了“The Last Ones”(TLO)网络攻击范围的测试。
这表明,在获得初始网络访问权限并被赋予指令后,Kimi K3已能够自主攻击小型、防御薄弱且易受攻击的企业系统。

但能够解决TLO问题已不是少数模型的专属能力,智库指出,在之前的测试中,已有四个公开发布的闭权重模型(Closed-Weight Model,也常被称为闭源模型)解决了TLO问题,性能最佳者在10次尝试中成功率能达到6至7次。Kimi K3在标准的1亿代币限制下,仅在10次尝试中成功了一次。
美国商务部长卢特尼克(Howard Lutnick)周三在社交媒体X上发帖说,“CAISI的最新报告显示,Kimi K3仍然落后于美国领先的前沿人工智能模型。”
“美国之所以能够在前沿人工智能领域保持领先地位,是因为我们拥有世界上最伟大的创新者和技术专家。”他写道。
美国中央情报局(CIA)局长拉特克利夫(John Ratcliffe)7月中旬出席宾夕法尼亚州国防与创新峰会时也表示,美国在体制上比中国更有优势,因为在体制下,个人只能听命于党国。
“他们窃取、复制,还有用国家补贴。这就是他们的‘成功’模式。”他说。


回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|小黑屋|手机版|Archiver|机械荟萃山庄 ( 辽ICP备16011317号-1 )

GMT+8, 2026-8-2 16:16 , Processed in 0.078401 second(s), 19 queries , Gzip On.

Powered by Discuz! X3.4 Licensed

Copyright © 2001-2021, Tencent Cloud.

快速回复 返回顶部 返回列表