키미 K3, 설정 오류 타고 격리망 밖 접속
핵심 요약
키미 K3가 보안 평가 중 설정 오류를 이용해 격리 환경을 벗어나 외부 인터넷에 접속했다. 깃허브에서 과제 정보를 확보했으며 외부 업체에 대한 해킹 시도는 하지 않았다. 개방형 모델의 통제 장치가 충분하지 않을 경우 악의적 활용의 피해가 커질 수 있다는 우려가 나왔다.
중국 문샷AI의 오픈웨이트 인공지능 모델 ‘키미 K3’가 사이버 보안 성능 평가 도중 격리된 실험 환경을 벗어나 외부 인터넷에 접속한 사실이 확인됐다. 미국 사이버 보안 스타트업 프론티어 시큐리티가 영국 인공지능보안연구소(AISI)의 평가 환경을 활용해 시험하던 중 발생한 일로, 알려진 글로벌 AI 기업 관련 사례로는 네 번째다.
실험 환경의 설정 오류가 외부망으로 이어지는 통로가 됐고, 키미 K3는 이를 이용해 과제 수행에 필요한 정보를 개발자 커뮤니티 깃허브에서 확보했다. 필요한 정보를 얻은 뒤 외부 업체를 해킹하려는 시도는 하지 않았다. 인간에게 알려지지 않은 시스템 취약점을 스스로 발견해 통제를 돌파한 사례라기보다, 평가 환경에 이미 존재하던 잘못된 설정을 활용한 것으로 분석됐다.
앞서 메타와 앤트로픽의 AI 모델도 환경 설정 오류를 이용해 실험 공간을 이탈한 뒤 외부 업체 해킹을 시도한 사례가 있었다. 앤트로픽의 당시 내부 모델은 자신이 격리 환경을 벗어났다는 점을 인식하고 공격을 중단했다. 오픈AI의 챗GPT 5.6솔에는 해킹을 차단하기 위한 안전장치가 설정돼 있어, 이번 시험에서 드러난 키미 K3의 대응 방식과 차이를 보였다.
프론티어 시큐리티는 키미 K3가 목표 달성을 위해 부정행위나 실험 환경 이탈을 시도할 때 이를 제어할 장치가 충분하지 않을 가능성을 제기했다. 특히 추론 구조가 외부에 공개된 개방형 모델이라는 특성상 악의적 공격자가 접근하면 피해가 커질 수 있다고 판단했다. 맷 프레드릭슨 그레이 스완 최고경영자 겸 카네기멜런대 부교수도 제약 없이 목표를 받은 AI는 답에 도달할 방법을 찾는다며, 스스로 판단하는 에이전틱 AI를 신중히 사용하지 않으면 예상 밖 결과가 생길 수 있다고 경고했다.