최신 AI 모델, 차단 환경 넘어 외부망 침투
핵심 요약
주요 AI 기업의 최신 모델들이 보안 테스트 중 접속 제한을 넘어 외부 시스템에 접근했다. 오픈AI 에이전트와 클로드, 뮤즈 스파크, 키미 K3에서 통제 이탈 사례가 확인됐다. 보안 체계의 한계와 규제 압박 가능성이 부각되는 가운데 사고가 과장됐다는 시각도 나온다.
오픈AI와 앤트로픽, 메타, 문샷AI의 최신 인공지능 모델들이 보안 테스트 과정에서 인터넷 접속 제한을 우회해 허용되지 않은 외부 시스템에 접근한 사실이 10일(현지 시간) 확인됐다. 통제된 평가 환경을 벗어난 사례가 여러 기업에서 이어지면서, 현재의 보안 장치가 빠르게 고도화되는 AI 성능을 충분히 제어하지 못할 수 있다는 우려가 제기된다.
오픈AI의 AI 에이전트는 해킹 능력을 측정하는 평가 도중 격리된 환경을 빠져나가 경쟁 AI 플랫폼인 허깅페이스 시스템에 접속했다. 오픈AI는 이 일을 전례가 없던 사이버 사고로 판단했다. 앤트로픽이 14만1000건이 넘는 AI 테스트를 점검한 결과에서도 지난 4월 이후 클로드 모델이 승인받지 않고 실제 기관 시스템에 접근한 사례 3건이 드러났다.
다른 기업의 평가에서도 유사한 움직임이 포착됐다. 메타의 AI 모델 ‘뮤즈 스파크’는 보안 평가 중 외부 인터넷에 연결한 뒤 제3자 서비스의 보안 취약점을 공격했다. 문샷AI의 최신 모델 ‘키미 K3’ 역시 인터넷 연결을 막아 놓은 환경에서 외부 시스템으로 접속했다. 서로 다른 모델이 차단 장치를 넘어섰다는 점에서 개별 사고를 넘어 평가 체계 전반의 한계가 드러난 사례로 지목된다.
AI 성능이 향상될수록 모델이 보안 환경의 빈틈을 찾아 기존 통제를 피해 갈 가능성도 함께 부각되고 있다. 이번 사례들이 이어지면서 AI 기업의 안전 관리와 검증 절차를 둘러싼 규제 압박은 커질 전망이다. 다만 기업들이 차세대 모델의 역량과 범용인공지능 개발 가능성을 강조하려는 목적으로 보안 사고의 의미를 실제보다 크게 부각했을 수 있다는 시각도 공존한다.