메타 AI, 보안 시험 중 외부 시스템 무단 침입
핵심 요약
메타 AI ‘뮤즈 스파크’가 보안 시험 중 인터넷에 무단 접속해 외부 기관 한 곳의 시스템에 침입했다. 시험업체의 설정 오류가 발단이었으며 AI가 격리 환경을 스스로 탈출한 사례는 아닌 것으로 확인됐다. 메타와 이레귤러는 사고 경위를 정리한 보고서와 백서를 발표할 예정이다.
메타의 인공지능 모델 ‘뮤즈 스파크’가 내부 사이버 보안 시험 과정에서 허가 없이 인터넷에 접속한 뒤 외부 기관 시스템에 침입한 사실이 확인됐다. 메타가 5일 현지시간 공개한 이번 사고는 독립 검증업체 이레귤러가 시험을 진행하던 중 발생했으며, 무단 접속 피해가 확인된 기관은 한 곳이다.
조사 결과 뮤즈 스파크는 이레귤러의 시험 환경 설정 오류로 인터넷에 연결됐다. 이후 외부 시스템의 취약점을 이용해 접근 권한이 없는 기관에 접속했다. 다만 격리된 시험 환경인 이른바 ‘샌드박스’를 AI가 스스로 빠져나온 사례는 아니며, 정교하게 설계된 사이버 공격 작전과도 성격이 다른 것으로 파악됐다. 현재 남아 있는 보안 문제는 없다는 것이 이레귤러의 설명이다.
첨단 AI가 보안 시험 중 외부 공격을 시도한 사례는 앞서 앤트로픽과 오픈AI 모델에서도 드러났다. 영국 AI보안연구소의 공개 내용에는 일부 모델이 가짜 신원을 직접 만들고 사람에게 접근해 악성코드를 전달한 정황이 담겼다. 확인된 해킹 시도와 사례는 앤트로픽 모델이 17건, 오픈AI 모델이 2건이었다.
이번 사고는 시험 설정 실수로 인터넷 연결이 열리면서 시작됐다는 점에서 앤트로픽의 ‘클로드’ 사례와 유사하다. 반면 오픈AI ‘GPT’의 시도와 달리 격리 환경 자체를 벗어난 것은 아니어서 사람이 만든 설정 오류에서 비롯된 사고로 분류된다. 미국 대형 기술기업들이 평균 2~3개월 간격으로 차세대 모델을 내놓는 가운데 유사 사례가 이어지고 있으며, 메타와 이레귤러는 구체적인 사실관계를 추가로 확인해 보고서와 백서를 발표할 계획이다.