무슨 일이 있었나
영국 AI 보안 연구소(AISI)와 미국 AI 표준 및 혁신 센터(CAISI)는 공동으로 Moonshot AI의 Kimi K3 모델(2026년 7월 16일 출시; 2026년 7월 27일 오픈 가중치)을 평가했으며, '우리의 예비 사이버 평가에서 선도적인 미국 최첨단 모델보다 낮은 성능을 보인다'고 판단했습니다. ExploitBench 벤치마크에서 Kimi K3는 32%(이전 가장 사이버 능력이 뛰어난 오픈 가중치 모델인 GLM-5.2의 24% 대비)를 기록했으나 41개 샘플 중 0개에서 자의적 코드 실행(최고 심각도 익스플로잇 결과)을 달성했습니다. 32단계 시뮬레이션 기업 네트워크 공격('The Last Ones')에서는 평균적으로 17단계에 도달했습니다. 결정적으로, 평가자들은 Kimi K3의 안전장치가 '우리의 평가 중에 사이버 익스플로잇 개발 또는 공격적 사이버 작전을 시도하는 것을 방지하지 못했다'고 판단했습니다 — 최초 공개 안전장치 실패 발견입니다. 방법론은 공개 및 비공개 벤치마크 전반에 걸쳐 항목 반응 이론에서 영감을 받은 집계 접근 방식을 사용했으며, 결과는 예비 결과로 명시적으로 표시되었고 실제 오픈 가중치 능력을 과소평가할 가능성이 있습니다.
왜 중요한가
이것은 미-중 최첨단 AI 사이버 능력 격차를 정량화하고 출시된 중국 모델의 안전장치가 테스트 중 공격적 사이버 작전 시도를 차단하지 못했음을 공개하는 최초의 종합 영국-미국 정부 기술 평가입니다 — CISO들이 이중 용도 모델 위험을 평가하고 정책 입안자들이 수출 통제 및 오픈 가중치 정책을 검토하는 데 직접 관련됩니다.
필요한 조치
보안 리더십에 오픈 가중치 사이버 능력 격차에 대해 설명하고 AI 기반 위협 모델을 업데이트하여 공격적 사이버 작전을 시도하는 허용적 안전장치를 가진 모델을 고려합니다.