Study: Kimi K3 Scores 32.2% in Cyberattack Test, Trails US Frontier Models by Over 40 Percentage Points

来源:TechFlow · 2026-07-24

AI 摘要

一句话摘要: 英美国安机构评测显示Kimi K3网络攻击能力32.2%,落后美国前沿模型超40个百分点。 关键事实: Kimi K3在ExploitBench基准得分32.2%,美国领先模型为76.2%,Kimi K3未实现任意代码执行,模拟内网攻击10次仅1次完整成功 涉及主体: Moonshot AI, Kimi K3, 英国AI安全研究所, 美国AI标准与创新中心, GLM-5.2 可能影响: 该评测可能影响中国开源模型在国际安全合规领域的信任度,同时加剧关于蒸馏训练导致能力上限的讨论,或推动中国模型厂商加大安全攻防投入。 是否值得继续跟踪: 是,因为该评测涉及国家级安全标准,后续若中美模型差距持续扩大,可能影响跨境模型部署与安全认证政策。 噪音/炒作风险: 低,评测来自官方安全机构,数据具体且与外部蒸馏质疑相互印证,非市场炒作。

阅读原文 →

← 更多文章