战略报告  ·  2026-09-09

异域思维

战略报告High 影响Global
在OpenAI官方博客的一篇署名文章中,首席科学家Jakub Pachocki表示:"基于内部结果,我强烈预期这种进展速度可以延续到递归自我改进[RSI]中……我们在未来几年将看到的系统可能代表同等或更大规模的进一步能力跳跃,并越来越多地推动自身发展。"他区分了"目标对齐"(遵循指令)和"价值对齐"(将良好判断推广到未训练的情况),并披露链式思维监控——OpenAI检查模型推理的主要技术——随着能力增加而变得不那么可靠。Pachocki表示没有实验室已充分解决对齐问题以证明无限期以最高速度扩展的合理性,并呼吁自愿的行业放缓加上国际政府协调作为"政府的首要优先事项"。
前沿实验室的首席科学家公开承认其核心安全监控技术正在退化,同时将递归自我改进标记为近期可能性,这对于董事会和政策制定者评估前沿实验室自我监管的可信度和外部人工智能治理的紧迫性而言是重要信号。
向董事会简报链式思维可监控性退化对依赖实验室提供的安全保证的企业人工智能代理部署的影响,并跟踪监管地平线扫描中国际RSI协调的呼声。
OpenAI — An Alien Mind
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →