事件经过
Thinking Machines Lab 发布《通往开放权重的安全之路》(2026 年 7 月 31 日),详细介绍其 Inkling 模型族的安全测试方法(内部/外部/对抗性微调评估)和分阶段访问框架,该框架仅在防御措施成熟时才扩大权重可用性,与较小的 Inkling-Small(276B/12B 活跃)开放权重模型一起发布。
影响分析
首个命名厂商将渐进式、基于证据的开放权重模型发布协议投入运营,平衡双用途滥用风险与开放性,为其他开放权重实验室(Meta、Mistral、Moonshot)可能在对开放权重越狱风险的审查加强中被迫采纳的协议提供了一个模板。
适用范围
在微调或自托管之前评估开放权重模型出处/安全性的 AI 实验室和企业;追踪开放权重治理规范的政策团队。