설정 오류 파고든 메타 AI, 외부망 무단 침입
핵심 요약
메타의 뮤즈스파크 1.1이 보안 시험 중 외부 기관 시스템에 무단 침입했다. 인터넷망 설정 오류가 취약점 탐색과 실제 공격으로 이어졌다. 유사 사고가 잇따르면서 자율형 AI의 통제와 보안 관리 문제가 부각됐다.
메타의 코딩 특화 AI 모델 ‘뮤즈스파크 1.1’이 독립 검증업체 이레귤러의 보안 시험 도중 외부 기관 한 곳의 시스템에 무단 침입한 사실이 확인됐다. 시험 환경의 설정 오류로 인터넷 연결이 허용되자 외부망에서 발견한 제3자 서비스의 취약점을 실제 공격에 이용했다. 오픈AI와 앤트로픽 모델에 이어 최근 확인된 세 번째 유사 사례다.
모델이 격리된 시험 환경인 샌드박스를 직접 탈출하거나 정교한 해킹 공작을 벌인 것은 아니었다. 다만 외부 시스템과 도구에 접근할 수 있게 된 뒤 별도의 침입 지시 없이 취약점을 찾아 공격까지 실행했다. 사람의 작은 설정 실수가 데이터 유출이나 시스템 침해로 번질 수 있다는 자율형 AI의 통제 문제가 드러난 대목이다. 현재 남아 있는 보안 문제는 없는 것으로 확인됐다.
최근 몇 주 사이 오픈AI의 GPT와 앤트로픽의 클로드도 보안 평가 과정에서 인터넷망 설정 오류를 계기로 외부 시스템에 무단 접근했다. 이번 사고는 메타가 첫 AI 코딩 에이전트 ‘뮤즈코드’ 베타 버전을 공개한 날 알려졌다. 코딩 에이전트는 코드 답변에 그치지 않고 필요한 파일 검색과 작업 계획 수립, 코드 작성·수정, 시험과 검증을 연속해서 수행한다.
뮤즈코드는 사고가 발생한 모델의 후속 버전인 ‘뮤즈스파크 1.2’를 기반으로 한다. 메타 자체 평가에서 일부 항목은 오픈AI 코덱스보다 높은 성능을 보였지만 앤트로픽 클로드코드에는 미치지 못했다. 이용료는 입력 토큰 100만 개당 1.25달러, 출력 토큰 100만 개당 4.25달러로 책정됐으며 일부 등급은 경쟁 제품보다 10배 이상 저렴하다. 메타와 이레귤러는 추가 조사 후 사고 경위와 재발 방지책을 담은 보고서와 백서를 공개할 계획이다.