一份来自英美两大AI安全机构的联合评测,把月之暗面最新模型Kimi K3的“另一面”摊在了阳光下。英国人工智能安全研究所与美国人工智能标准与创新中心合力给这款模型做了一次攻击性网络任务体检,结论是:它在漏洞利用开发和模拟网络攻击上大幅落后于美国领先的前沿模型。
ExploitBench:41个真实漏洞,美国模型76.2%对K3的32.2%
这场“考试”用的第一份试卷,是卡内基梅隆大学开发的ExploitBench基准。它从2023年之后Chrome V8引擎里挖出41个真实漏洞,沿着软件利用的推进过程一路打分。
结果分差惊人:美国领先模型平均拿下76.2%,Kimi K3只有32.2%。更关键的是等级——41项任务里,Kimi K3一项都没摸到最高的“任意代码执行”。那是最凶险的利用等级,意味着攻击者能完全掌控目标系统;而美国模型在41项里攻下了20项ACE。
“最后的幸存者”:美国模型走28.5步,K3只到17步
第二份试卷叫“最后的幸存者”,模拟的是一次横跨四个子网、约20台主机的企业网络攻击,整条路径32个步骤,研究机构说人类专家大概要啃20个小时。目前全球只有少数模型能真的通关,迄今四个公开可用的闭源权重模型过了这关。
Kimi K3平均走到第17步就卡住,美国领先模型能推到第28.5步。它在十次尝试里有一回在1亿token的限制内跑通了整条攻击链,说明能力是有的,只是调不动、不稳定。机构下了句判断:只要给到初始网络访问权限、再下一道指令,Kimi K3就能自主啃下规模较小、防御薄弱又易攻的企业系统。
安全护栏形同虚设,模型配合攻击无阻力
更刺眼的是,Kimi K3的安全护栏几乎没能拦住漏洞利用的开发,模型在配合这类操作时没遇到像样的阻力。在测试过程中,该模型在被要求开展相关任务时未出现明显拒绝行为,存在被滥用于网络攻击的潜在风险。
值得补一句的是,英美机构在测试美国闭权重模型时关掉了系统级安全防护,只为量出它们的最大本领,而那些防护在公开版本里是默认开着的。公开版本里那些防护是默认激活的——也就是说,76.2%是“脱掉防弹衣”的极限成绩。即便如此,差距仍然触目惊心。
时间线拉长:中国模型在追,但始终落后一截
CAISI用Elo评分体系追踪了自2025年初以来中美模型的网络能力,两条趋势线都在上扬,红色的中国线与蓝色的美国线之间却一直有缝。Elo提升400分意味着解决任务的概率涨十倍——这差距不是小数。英国机构此前把开源模型与美国系统的性能差估在四到七个月,最新结果正好落在这条规律里。
蒸馏疑云:测试结果恰好能解释指控
最耐人寻味的一笔,落在测试结果和蒸馏指控的交叉点上。
7月22日,白宫科技政策办公室主任迈克尔·克拉齐奥斯公开指控月之暗面利用Anthropic的Claude Fable模型进行蒸馏来开发Kimi K3,还称对方拿到了受美国出口管制的英伟达GB300芯片。美国财政部长贝森特称,若证实中国企业隐蔽且工业化规模蒸馏构成知识产权窃取,将考虑实施制裁和列入贸易黑名单。
而通用基准成绩漂亮、网络安全得分却塌了一截,恰好能用这套说法解释:Kimi K3大概率主要吃的是Claude在通用知识、编程和智能体任务上的输出;Anthropic的安全分类器会专门掐掉高级攻击性网络查询,于是这类样本在蒸馏数据集里占比极低——模型因此能在标准榜上和西方对手叫板,却没学到更深的漏洞利用本事。
否认与反击:月之暗面称指控“完全没有根据”
月之暗面企业业务负责人黄震昕早前明确否认,强调K3性能跃升的核心来自底层原创架构创新,并非对现有模型进行蒸馏复刻。中国驻美使馆发言人刘畅表示,克拉齐奥斯的言论完全没有根据,强调中国尊重知识产权保护,美国相关人士应尊重事实,摒弃偏见,停止诋毁抹黑中国AI产业。
Kimi员工的反讽回应也引发关注:Fable于7月1日发布,K3于7月15日推出,“我们在短短15天内训练了一个全新的前沿模型”。有分析指出,K3早在四五月份已内测,比Fable5发布还早。美国网民调侃:中国人想必拥有时光机了。
围绕Kimi K3模型是否涉嫌蒸馏,西方科技圈内部目前仍有分歧。但无论如何,英美安全机构的这份评测已经给这场争议添上了一笔关键注脚——无论K3是怎么练出来的,它在攻防这张考卷上的成绩,确实远不如它在编程榜上的排名那么耀眼。
