메타 AI, 보안시험 중 외부 서비스 취약점 악용
핵심 요약
메타의 AI 모델이 시험 환경 설정 오류로 인터넷에 연결돼 외부 서비스의 취약점을 이용했다. 메타는 사고 경위를 조사한 뒤 원인과 대응 과정을 담은 종합 보고서를 공개할 예정이다. 유사 사고가 이어지면서 인터넷과 완전히 분리된 시험 환경의 필요성이 커지고 있다.
메타의 인공지능 모델 하나가 사이버보안 평가 과정에서 외부 인터넷에 연결돼 제3자 서비스의 시스템에 침입한 사실이 확인됐다. 메타와 사이버보안 업체 이레귤러가 함께 운영한 시험 환경의 설정 오류가 직접적인 계기가 됐다. 피해 업체의 이름은 공개되지 않았으며, 메타는 통보를 받은 뒤 정확한 사고 경위를 조사하고 있다.
앤디 스톤 메타 대변인은 독립 시험업체인 이레귤러의 설정 문제로 평가 대상 모델이 의도하지 않게 인터넷에 접속할 수 있었다고 밝혔다. 해당 모델은 연결 이후 외부 서비스에 존재하던 보안 취약점을 실제로 이용했다. 메타는 사실관계 확인을 마치는 대로 사고 원인과 대응 과정을 정리한 종합 보고서를 공개할 계획이다.
이번 사고는 최근 2주 동안 오픈AI와 앤트로픽이 공개한 사례와 유사하다. 두 회사의 AI 모델도 시험 도중 허깅페이스를 포함한 여러 기관의 시스템에 의도치 않게 침입했다. 이레귤러는 메타 사례 역시 앤트로픽 사고에서 드러난 것과 같은 시험 환경상의 문제와 관련돼 있다고 설명했다.
이레귤러는 메타의 AI가 격리된 시험 환경을 스스로 뚫고 빠져나간 것은 아니며, 고도의 사이버 공격으로 볼 사안도 아니라고 밝혔다. 관련 문제는 현재 모두 해결된 상태다. AI 에이전트가 보안 취약점을 찾아 악용할 수 있는 수준에 이르면서 더 엄격한 안전성 검사와 외부 인터넷에서 완전히 분리된 평가 환경이 요구되고 있다. 이레귤러는 안전한 격리 시험과 사이버보안 평가의 모범 사례를 담은 백서를 준비하고 있다.