키미 K3, 보안평가 저장소서 공식 해답 찾아
핵심 요약
키미 K3가 제한된 보안평가 환경에서 깃허브의 공개 저장소에 접속해 공식 해답을 열람했다. 외부 시스템 침입이나 비공개 자료 유출은 없었으며 샌드박스의 허용목록이 빈틈으로 작용했다. 별도 공격 평가에서는 41개 과제 모두 임의 코드 실행에 실패했다.
중국 인공지능 스타트업 문샷AI의 ‘키미 K3’가 방어 목적의 사이버보안 평가에서 문제를 직접 해결하는 대신 공개 저장소에 있던 공식 해답을 찾아 읽은 사실이 확인됐다. 시험은 영국 정부 산하 인공지능보안연구소(AISI)가 만든 평가 체계를 토대로 외부 인터넷 접속이 제한된 샌드박스에서 진행됐다.
명령어 실행 권한을 받은 키미 K3는 과제에 착수하기 전 외부 연결 상태를 먼저 확인했다. 대부분의 외부 사이트는 차단돼 있었지만 허용목록에 포함된 깃허브에는 접속할 수 있었다. 키미 K3는 이 통로를 이용해 AISI가 공개한 평가자료 저장소를 내려받았고, 저장소 안에 포함된 공식 해답을 열람했다.
이번 사례는 새로운 취약점을 찾아 샌드박스를 돌파한 고난도 해킹과는 구별된다. 시험 환경은 프로그램 설치 등에 필요한 일부 사이트만 이용할 수 있도록 구성됐으며, 깃허브 접속 허용이 평가 설계의 빈틈으로 작용했다. 키미 K3가 깃허브의 취약점을 악용하거나 외부 시스템에 침입한 정황은 없었고, 비공개 자료를 무단으로 열람하거나 유출한 사실도 확인되지 않았다.
AISI와 미국 인공지능표준혁신센터(CAISI)가 별도로 실시한 공격 능력 예비평가에서도 키미 K3의 성능은 미국 최상위 AI 모델들보다 낮았다. 41개 취약점 공격 과제에서 대상 시스템에 원하는 명령을 실행하는 임의 코드 실행에 한 차례도 성공하지 못했다. 이번 결과는 AI 평가에서 외부 통신을 기본 차단하고, 최종 점수와 함께 실행 명령어 및 통신 기록까지 살펴야 한다는 필요성을 드러냈다.