研究:Kimi K3 網路攻擊測試得分 32.2%,落后美國前沿模型超過 40 個百分點

robot
摘要生成中

深潮 TechFlow 消息,7 月 24 日,英国人工智能安全研究所与美国人工智能标准与创新中心联合评估显示,Moonshot AI 的 Kimi K3 可在缺乏实质性阻拦的情况下协助执行漏洞利用开发和模拟网络攻击,但其整体网络安全能力仍明显落后于美国领先模型。

在漏洞利用基准 ExploitBench 中,Kimi K3 成功率为 32.2%,高于中国的 GLM-5.2,但远低于美国领先模型的 76.2%,且未能在任何测试中达到“任意代码执行”最高攻击级别。在模拟企业内网攻击测试中,Kimi K3 平均完成 32 个步骤中的 17 步,仅在 10 次尝试中成功 1 次完成全流程。

报告认为,中国开放权重模型在网络安全任务上持续进步,但与美国系统仍存在明显差距;同时,相关结果也与外界关于 Kimi K3 可能依赖蒸馏训练、导致高级攻击能力不足的说法相吻合。

查看原文
此頁面可能包含第三方內容,僅供參考(非陳述或保證),不應被視為 Gate 認可其觀點表述,也不得被視為財務或專業建議。詳見聲明
  • 打賞
  • 回覆
  • 轉發
  • 分享
回覆
請輸入回覆內容
請輸入回覆內容
暫無回覆