AI 보안시험 잇단 외부 접속, 공통 환경 오류 확인
핵심 요약
오픈AI·앤트로픽·메타의 AI 보안시험 사고에서 동일한 이레귤러 평가 환경이 확인됐다. 구성 오류로 모델의 인터넷 접근이 가능했으며 메타는 관련 사안을 조사하고 있다. 이레귤러는 미해결 문제는 없다며 안전한 시험 절차를 담은 백서를 준비 중이다.
오픈AI와 앤트로픽, 메타플랫폼의 인공지능 모델이 내부 사이버 보안 시험 중 인터넷에 접속해 외부 기관의 시스템을 해킹한 사건에 동일한 평가 환경이 사용된 것으로 확인됐다. 세 회사의 시험에는 이스라엘 스타트업 이레귤러가 운영하는 테스트베드가 공통으로 활용됐으며, 업체는 일련의 사건이 하나의 평가 환경 문제에서 비롯됐다고 설명했다.
오픈AI는 지난 4일 테스트 환경에 구체적으로 공개되지 않은 구성 오류가 있어 모델의 인터넷 접근이 가능했다고 밝혔다. 앤트로픽도 그보다 일주일 앞서 며칠간 데이터를 분석한 뒤 클로드 모델의 인터넷 접속 가능성을 이레귤러에 알렸다. 메타 역시 자사 모델이 인터넷을 통해 외부 시스템을 해킹한 사실을 공개했으며, 이레귤러로부터 관련 내용을 전달받아 현재 조사하고 있다.
설립 3년차인 이레귤러는 AI 모델의 성능과 보안 취약성을 검증하는 평가 테스트베드를 운영한다. 세쿼이아와 레드포인트 벤처스로부터 유치한 투자금은 모두 8천만달러이며, 지난해 기업가치는 4억5천만달러로 평가됐다. AI 개발사들이 자체 평가 대신 독립적인 외부 시험을 요구받으면서, 사이버 보안 평가처럼 전문성이 필요한 영역에서 소수 업체의 역할도 커진 상황이다.
이레귤러는 이번 사례에 샌드박스 탈출이나 정교한 사이버 공격이 포함되지는 않았으며 현재 남아 있는 미해결 문제도 없다고 밝혔다. 업체는 사이버 보안 시험을 안전하게 수행하기 위한 백서를 작성하고 있다. 기업용 스타트업 본에서 AI 부문을 이끄는 순딥 비미레디는 개발사가 자사 모델을 직접 평가하기보다 외부 업체가 독립적인 시험을 수행할 필요가 있다고 강조했다.