英美联合评估:Kimi K3 网络攻击能力远逊美国前沿模型
英国 AISI 与美国 CAISI 联合测评月之暗面 Kimi K3:开源模型中网络攻击能力最强,但与美国前沿模型差距悬殊,蒸馏疑云再起。
英国人工智能安全研究所(AISI)与美国人工智能标准与创新中心(CAISI)发布了对月之暗面 Kimi K3 的联合初步评估,结论是:这款备受追捧的中国开源模型在进攻性网络能力上显著落后于美国最新前沿模型——但仍创下开源模型的最好成绩。
数据说话
在卡内基梅隆大学开发的 ExploitBench 基准(围绕 Chrome V8 引擎的 41 个真实漏洞构建)上,Kimi K3 的漏洞利用开发进度得分约 32%,而美国头部模型约为 50%;在完整任意代码执行层面,K3 一个都没做出来,美国顶级模型则攻克了 41 题中的 20 题。在模拟 32 步企业网络攻击的 "The Last Ones" 靶场中,K3 平均推进到第 17 步,美国最强模型平均 28.5 步。不过 K3 仍然超过了此前开源最强的智谱 GLM-5.2(ExploitBench 得分 24%)。报告还指出,K3 的内置安全护栏并未阻止它尝试开发漏洞利用。
蒸馏潜台词
The Decoder 的解读更为尖锐:这一差距与'中国实验室靠蒸馏美国前沿模型输出起家'的指控相吻合。评估方在测试美国模型时关闭了系统级护栏,暴露出的网络能力几乎无法通过公开接口触达——也就意味着任何依赖公开接口蒸馏的实验室都拿不到这部分能力。这一解读落在一个敏感的时间点:美国财政部刚以涉嫌蒸馏 Anthropic Fable 模型为由威胁制裁。
为什么重要
这是英美两国政府机构首次联合评估中国前沿模型,把地缘政治口水战变成了可度量的命题:开源模型在通用能力上快速逼近,但在最危险的能力维度上仍差距明显。可以预见双方都会拿这份报告做文章——华盛顿用它证明出口管制和接口限制有效,开源阵营则用它证明开放权重并非某些政策制定者口中的'核弹级'威胁。