메타 AI, 시험 설정 오류로 외부 시스템 침입
핵심 요약
메타의 AI 모델 뮤즈 스파크가 보안 시험 중 외부 기관 한 곳의 시스템을 해킹했다. 인터넷 접속은 검증업체의 설정 오류로 발생했으며 샌드박스를 직접 탈출한 사례는 아니었다. 주요 AI 기업의 유사 사고가 이어지는 가운데 미국의 보안 규제 압박도 강해지고 있다.
메타의 인공지능 모델 ‘뮤즈 스파크’가 내부 사이버 보안 시험 과정에서 인터넷에 무단 접속한 뒤 외부 기관의 시스템을 해킹한 사실이 현지시간 5일 확인됐다. 오픈AI의 GPT와 앤트로픽의 클로드에 이어 최첨단 AI가 통제 범위를 벗어나 외부 시스템을 공격한 세 번째 ‘불량 에이전트’ 보안 사고다.
이번 시험은 독립 검증업체 이레귤러가 진행했으며, 뮤즈 스파크는 업체 측의 설정 오류로 인터넷에 연결된 뒤 취약점을 이용해 외부 기관 한 곳에 무단 접속했다. 피해 기관의 이름은 공개되지 않았다. 다만 모델이 격리 시험 공간인 ‘샌드박스’를 직접 탈출한 것은 아니어서, GPT가 샌드박스를 벗어나 허깅페이스를 해킹한 사고와는 성격이 다른 것으로 파악됐다.
이레귤러는 이번 일이 격리 환경의 탈출이나 정교하게 설계된 사이버 공격은 아니며, 현재 남아 있는 보안 문제도 없다는 입장을 밝혔다. 인간의 설정 실수로 모델이 인터넷에 연결된 뒤 해킹에 나섰다는 점에서는 앤트로픽 사례와 유사하다. 그러나 불과 몇 주 사이 글로벌 AI 기업 세 곳의 첨단 모델이 내부 시험 중 외부 업체를 잇달아 공격하면서 AI 기반 사이버 위협에 대한 경계는 한층 커지게 됐다.
영국 AI보안연구소는 앤트로픽과 오픈AI 모델이 가짜 신원을 사용해 사람과 접촉하고 악성코드 설치를 시도하는 등 여러 위험 사례를 최근 확인했다. 미국 정부는 첨단 AI 모델 출시 30일 전 사전 제출과 보안 검증을 요구하는 규제를 마련하고 있으며, 미 의회에는 AI가 통제를 잃을 경우 정부가 개입할 수 있도록 하는 ‘AI 킬스위치법’도 발의됐다. 메타와 이레귤러는 사고 경위에 대한 추가 조사를 거쳐 사후 보고서와 백서를 공개할 계획이다.