영국 AISI와 미국 NIST 산하 CAISI의 공동 평가 결과, 문샷 AI '키미 K3'의 사이버 공격 능력이 미국 최상위 모델에 크게 못 미치는 것으로 나타났다. 익스플로잇벤치에서 키미 K3는 32.2%로 미국 상위 모델 평균 76.2%에 크게 뒤졌고, 임의 코드 실행은 41개 과제 중 0건(미국 모델은 20건 성공)이었다. 다만 기존 오픈웨이트 최강 GLM-5.2(24%)는 넘어섰고, 소규모 기업 시스템 32단계 공격 경로를 1차례 완주해 자율 공격 가능성도 보였다. 전문가들은 안전장치가 걸린 미국 모델 출력을 증류(Distillation)해 학습한 탓에 공격 노하우가 데이터에 빠진 구조적 한계로 분석하며, 방어적 보안에선 최상위급인 중국 모델이 공세 역량에선 여전히 격차가 있음을 보여준다.
- •영 AISI·미 CAISI 공동 평가: 키미 K3 익스플로잇벤치 32.2% vs 미국 상위 모델 평균 76.2%
- •임의 코드 실행 41개 과제 중 0건 성공, 미국 모델은 20건 성공
- •기존 오픈웨이트 최강 GLM-5.2(24%)는 능가, 소규모 시스템 자율 공격 가능성은 입증
- •안전장치 걸린 미국 모델 출력을 증류한 학습 방식의 구조적 한계로 분석
- •아이키도 평가에서는 취약점 탐지 23/26으로 최상위급, 공격·방어 역량 격차 부각
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
영·미 정부 "키미 K3 사이버 공격력 기대 이하"...'증류' 한계 드러냈다

- 1.영 AISI·미 CAISI 공동 평가서 키미 K3 익스플로잇벤치 32.2%, 미 최상위 평균 76.2%에 크게 미달
- 2.임의 코드 실행은 41개 과제 전패, 미 선도 모델은 20개 성공…사이버 레인지도 17 vs 28.5단계
- 3.GLM-5.2(24%)는 능가, 10회 중 1회 32단계 공격 경로 완주로 자율 공격 가능성 입증
- 4.아이키도 평가선 취약점 26개 중 23개 탐지로 GPT-5.6 테라급…탐지·공격 역량 괴리 부각
왜 중요한가?
미국 최상위 모델 출력을 증류한 학습으로는 안전장치에 걸러진 공격 노하우까지 복제하지 못한다는 구조적 한계를 정부 공동 평가로 확인했다. 중국 오픈소스 AI가 방어적 보안에선 미국과 대등하지만 공세 역량 격차는 뚜렷하다는 이중적 구도를 보여준다.
본문 미리보기
문샷 AI의 '키미 K3'가 사이버 공격 수행 능력에서 미국 최상위 AI 모델들에 크게 미치지 못한다는 영국과 미국 정부 공동 연구 결과가 나왔다. 최근 중국 오픈소스 AI의 급격한 발전에 대한 미국의 경계가 커지는 가운데, 적어도 사이버 공격 역량에서는 미국 선도 모델과 상당한 격차가 존재한다는 평가다.영국 과학혁신기술부 산하 AI 안전연구소(AISI)와 미국 상무부 국립표준기술연구소(NIST) 산하 AI 표준·혁신센터(CAISI)는 24일(현지시간) 공동 보고서를 통해 키미 K3의 사이버 보안 관련 성능을 평가한 결과를 공개했다
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:59AI 초안

