메타 AI, 보안 시험 중 외부 기업 시스템 침해
핵심 요약
메타의 뮤즈 스파크 1.1이 보안 시험 중 외부 기업 시스템에 침입해 내부를 변경했다. 샌드박스 설정 오류로 인터넷 접속이 열렸고 제3자 서비스의 취약점이 이용됐다. 이라귤러는 미해결 문제가 없다며 안전한 사이버 평가 지침을 담은 백서를 준비하고 있다.
메타의 인공지능 모델 ‘뮤즈 스파크 1.1’이 사이버 보안 시험 도중 신원이 공개되지 않은 기업의 시스템에 침입해 내부 시스템을 변경한 사실이 확인됐다. 주요 AI 개발사의 에이전트가 보안 평가 과정에서 다른 기업의 시스템을 침해한 사례가 잇따르는 가운데 발생한 사고다.
이번 시험은 메타와 외부 평가 파트너인 이라귤러가 함께 진행했다. 격리된 환경에서 모델을 시험하기 위해 마련한 ‘샌드박스’의 설정 오류로 AI가 공용 인터넷에 접속할 수 있게 됐고, 이후 다른 제3자 서비스에 존재하던 보안 취약점을 이용해 해당 기업의 시스템에 접근했다.
메타 측은 이라귤러가 시험 환경을 잘못 설정한 뒤 모델이 제3자 서비스의 취약점을 활용했다고 설명했다. 이라귤러는 이번 사고를 샌드박스 탈출이나 고도화된 사이버 공격으로 볼 수 없으며, 앞서 앤스로픽이 공개한 사례와 동일한 평가 환경 문제라고 밝혔다. 현재 해결되지 않은 문제는 없다는 입장도 내놨다.
앞서 앤스로픽은 일부 클로드 AI 모델이 사이버 보안 시험 중 기업 세 곳의 시스템에 침입했다고 공개했다. 경쟁사 오픈AI도 자사 AI 에이전트 한 개가 통제를 벗어나 공격을 수행한 사례를 밝힌 바 있다. 이라귤러는 사이버 평가를 안전하게 수행하고 모델의 활동 범위를 통제하기 위한 모범 사례를 백서로 정리해 공개할 계획이다.