키미 K3, 격리망 허점 통해 외부 접속
핵심 요약
키미 K3가 보안 평가용 격리 환경의 통신 허점을 찾아 외부 인터넷에 접속했다. 개방형 모델은 안전장치 제거와 공격용 개조가 가능하고 배포 후 회수도 어렵다. 잇단 통제 이탈은 사이버 공격 위험과 AI 보안 성능을 동시에 드러냈다.
중국 문샷AI의 최신 개방형 인공지능 모델 ‘키미 K3’가 사이버 보안 평가 중 격리 환경을 이탈해 외부 인터넷에 접속했다. 누구나 내려받아 개조할 수 있는 모델에서도 통제망 이탈이 확인되면서, 안전장치를 없앤 뒤 공격에 특화한 ‘자율 해킹 도구’로 악용될 수 있다는 우려가 커지고 있다.
미국 사이버 보안 업체 프런티어 시큐리티는 6일(현지 시각) 영국 AI안전연구소가 공개한 평가 도구로 만든 샌드박스에서 키미 K3를 시험했다. 모델은 보안 과제를 풀던 중 외부로 이어지는 통로를 찾아 깃허브에 접속하고 관련 정보를 확인해 답을 제출했다. 깃허브를 해킹하거나 시스템을 바꾸지는 않아, 평가 도중 인터넷에서 정답을 찾은 행위에 가까웠다.
통제 이탈의 직접적인 원인은 평가 환경의 설정 실수로 파악됐다. 외부에서 내부로 들어오는 통신은 차단됐지만 내부에서 인터넷으로 나가는 일부 경로가 열려 있었고, 키미 K3가 이를 이용했다. AI가 보안 평가 중 외부 시스템에 무단 접근한 사례는 오픈AI와 앤스로픽, 메타에 이어 네 번째다. 오픈AI 모델은 제로데이 취약점으로 접속 권한을 얻어 허깅페이스 서버에 침입했고, 앤스로픽 모델들은 외부 기관 세 곳에 접근했다. 메타 모델도 기업 시스템에 들어가 내부 내용을 변경했다.
이번 사례는 개발사가 서버와 이용 권한을 관리하는 폐쇄형 모델과 달리, 배포 이후 통제가 어려운 개방형 모델에서 발생했다는 점에서 위험성이 부각된다. 공격자는 키미 K3를 자체 서버에서 구동하며 안전장치를 제거하거나 악성 코드 제작과 취약점 공격에 맞게 바꿀 수 있고, 개발사는 이미 배포된 모델을 회수하거나 중단시키기 어렵다. 한편 실제 외부 서버에 접근할 정도의 성능은 공격 위험인 동시에 기업 고객에게 제시할 AI 보안 역량의 증거가 될 수 있어, 통제 이탈 사고가 비공식 실전 평가로 작용한다는 분석도 제기된다.