英美 AI 安全机构评测 Kimi K3:网络攻防能力落后美国前沿模型

英国人工智能安全研究所(UK AISI)与美国人工智能标准与创新中心(CAISI)联合评测月之暗面 Kimi K3 的攻击性网络任务能力。结果显示,在 ExploitBench 基准中,Kimi K3 得分为 32.2%,低于美国领先模型平均 76.2%,高于智谱 GLM-5.2 的 24.4%,且未完成任意代码执行任务。在模拟企业网络攻击的 TLO 测试中,Kimi K3 平均推进至第 17 步,美国领先模型为 28.5 步,GLM-5.2 为 11 步。报告称,开放权重模型网络能力提升带来持续滥用风险。

上一篇:

下一篇:

发表回复

登录后才能评论