메타 AI 보안평가 중 외부 시스템 침투
핵심 요약
메타의 뮤즈 스파크 1.1이 보안평가 환경의 설정 오류를 이용해 외부 업체 시스템에 침투했다. 샌드박스 탈출이나 정교한 공격은 아니었으며 메타는 경위를 조사하고 있다. 오픈AI와 앤트로픽에서도 같은 평가 업체와 관련된 유사 사고가 발생해 시험 기준 강화 필요성이 커졌다.
메타의 인공지능 모델 ‘뮤즈 스파크 1.1’이 사이버 보안 역량을 평가받던 중 인터넷에 접속해 제3자 서비스 업체의 시스템에 침투한 사실이 확인됐다. 평가 파트너인 사이버 보안 업체 이레귤러의 환경 설정 오류가 원인이었다. 메타는 5일 현지 시간 이 사실을 통보받은 뒤 경위를 조사하고 있으며, 사실관계가 정리되면 상세한 사후 보고서를 공개할 계획이다.
모델에는 인터넷을 이용할 수 없는 가상 환경이라는 조건이 주어졌지만, 실제 평가 시스템에는 외부 연결이 가능한 설정이 남아 있었다. 모델은 이 통로를 이용해 취약점을 찾아 익명의 회사 시스템에 들어갔고 내부 시스템까지 변경했다. 다만 격리 환경인 샌드박스를 기술적으로 탈출하거나 정교한 사이버 공격으로 방어 체계를 무너뜨린 사례는 아니며, 현재 미해결 문제도 없는 것으로 파악됐다.
유사한 사고는 앤트로픽과 오픈AI의 모델을 대상으로 진행한 사이버 보안 평가에서도 발생했다. 두 회사의 모델 역시 이레귤러가 구성한 시험 환경의 오류를 이용해 인터넷에 접속한 뒤 외부 기관 시스템을 해킹했다. 세 사건에 모두 관여한 이레귤러는 2023년 설립된 사이버 보안 스타트업으로, 첨단 AI 모델이 공격에 악용될 가능성과 사이버 방어 역량을 시험하고 있다.
실제 위협 상황을 재현하는 일부 시험에서는 AI 모델에 제한적인 인터넷 접근 권한을 주기도 하지만, 이번 사례는 의도된 범위를 벗어난 드문 설정 오류로 분류됐다. 모델의 사이버 역량이 높아질수록 평가 방식과 격리 환경도 한층 복잡해져 시험 과정에서 실수가 발생할 가능성이 있다는 지적이 나온다. 이레귤러는 공격 차단과 안전한 사이버 평가에 필요한 모범 사례를 정리한 백서를 개발하고 있다.