战略报告  ·  2026-09-11

衡量AI模型的战术情报目标和常规武器能力

战略报告High 影响Global
Anthropic的前沿红队发布了新的评估,衡量AI在战术情报目标(例如,从碎片化信息定位人员)和常规武器开发(例如,工程设计无人机以打击移动目标)中的能力。头条发现:"对于军事和情报领域的某些任务,模型可以做历史上只有一群稀缺、训练有素的人类专家才能做的事情。"使用跨社交媒体身份关联场景(WhatsApp、Telegram、Instagram、Facebook)的200个模拟任务管道,该团队发现前沿模型在"发现、确定、追踪、目标"杀链任务上取得一致进展;来自中国开发者的开放权重模型经测试落后于前沿但仍显示出"令人担忧的识别和目标化对手的能力,以及改进武器性能的能力"。Anthropic声称这促使其实施新的平台分类器来阻止此类滥用。
国防和情报相关企业以及政策制定者需要重新校准对哪些军事/情报任务需要稀缺人类专业知识与当前前沿甚至二线开放权重模型现在可以近似的任务的假设。
在评估平台保障和出口管制态势时,向国家安全和国防部门客户简述AI支持的目标和武器开发任务的能力下限的转变。
Anthropic — Measuring AI capabilities in intelligence targeting and conventional weapons
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →