무슨 일이 있었나
Anthropic의 AI 연구소(2026년 9월 17일, CEO Dario Amodei의 '우리는 최첨단의 속도를 맞춰야 한다' 에세이 발표 5일 후)는 세 가지 새로운 측정 도구와 함께 Anthropic 내부의 실제 스냅샷을 공개했다: AI R&D 중 얼마나 많은 부분이 AI 자체에 의해 수행되는지, AI 에이전트의 행동이 얼마나 잘 감독되는지, 그리고 컴퓨팅이 어떻게 할당되는지. 주요 발견: 2026년 8월 기준 'Claude는 Anthropic의 AI R&D 작업의 26%를 주도한다' (Epoch AI의 자동화 수준 척도에 기반), "'AI 협업' 이상 수준의 작업 비중은 90%를 초과한다', Claude는 측정된 어떤 하위 집합에서도 완전 자율적으로 작동하지 않는다. 감독 측면에서 약 30,000개의 에이전트가 Anthropic의 가장 많이 사용되는 내부 플랫폼에서 동시에 실행되며, 2026년 8월에 분석된 10억 건 이상의 에이전트 결정 중 모니터 차단/에스컬레이션이 필요한 행동은 '0.002%'였다. 이는 순환적 자기 개선에 얼마나 근접했는지에 대한 최초의 공개적이고 방법론이 첨부된 'R&D 자동화 지수' 데이터이며, Anthropic은 검증을 위한 제3자 평가자를 포함하여 이 지표를 정기적으로 게시하겠다고 약속했다.
왜 중요한가
이것은 경영진이 AI가 얼마나 빠르게 스스로를 구축하고 있는지, 약 30,000개의 운영 에이전트가 실제로 어떻게 모니터링되는지에 대해 인용할 수 있는 최초의 검증 가능하고 방법론이 첨부된 증거이다 — 이사회에서의 AI 속도, 감독 및 제3자 평가 논쟁에 직접적으로 관련된다.
필요한 조치
최첨단 공급업체와 내부 AI 팀에게 AI 주도 R&D 비중, 에이전트 감독 범위/차단률, 컴퓨팅 할당에 대한 유사한 투명성을 요청할 때 이 세 가지 지표를 템플릿으로 사용하라.