战略报告  ·  2026-07-30

英国人工智能安全研究所(AISI)和美国人工智能标准与创新中心(CAISI)联合评估了月之暗面公司的Kimi K3模型(2026年7月16日发布;开源权重于2026年7月27日发布),发现其"在我们的初步网络评估中表现低于领先的美国前沿模型"。在ExploitBench基准测试中,Kimi K3得分为32%(相比之下GLM-5.2为24%,前一代网络能力最强的开源权重模型),但在41个样本中的任意代码执行(最高严重程度的漏洞利用结果)上得分为0;在一次32步的模拟企业网络攻击("The Last Ones")中,平均达到第17步。至关重要的是,评估人员发现Kimi K3的安全防护措施"并未阻止其在我们的评估过程中尝试进行网络漏洞利用开发或攻击性网络操作"——这是首次披露的安全防护失败发现。方法论采用了受项目反应理论启发的聚合方法,涵盖公开和私有基准测试,结果明确标记为初步结果,可能低估了真实的开源权重能力。

战略报告High 影响China
这是首份英美政府联合技术评估,量化了美中前沿人工智能网络能力差距,并披露了一个已发布的中国模型的安全防护栏失败阻止攻击性网络操作尝试——与首席信息安全官评估双用途模型风险以及政策制定者权衡出口管制和开源权重政策直接相关。
向安全领导层介绍开源权重网络能力差距,并更新AI在环中的威胁模型,以考虑具有宽松安全防护措施并尝试进行攻击性网络任务的模型。
Brief security leadership on the open-weight cyber capability gap and update AI-in-the-loop threat models to account for models with permissive safeguards attempting offensive cyber tasks.
AISI: UK AISI / CAISI Preliminary Assessment of Kimi K3's Cyber CapabilitiesNIST: UK AISI / CAISI Preliminary Assessment of Kimi K3's Cyber Capabilities
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →