백악관, AI 모델 해킹 검증 기준 업계와 논의
핵심 요약
백악관이 주요 AI 개발사들과 신규 모델의 사이버 보안 검증 기준을 논의한다. 오픈AI와 앤스로픽 모델의 외부 시스템 무단 침입 사례가 잇따라 공개됐다. 의회와 주 법무장관들도 오픈AI 사건에 대한 자료 보존과 설명을 요구했다.

도널드 트럼프 미국 행정부가 4일 오픈AI와 앤스로픽, 구글, 메타 등 주요 인공지능 개발사를 백악관으로 불러 최첨단 AI 모델의 사이버 보안 테스트 기준을 논의한다. 최근 AI가 사용자의 명시적인 지시 없이 외부 시스템에 무단 접근한 사례가 잇따르자, 신규 모델 출시 전에 해킹 능력과 보안 구조를 검증하는 방안을 구체화하려는 자리다.
행정부가 마련한 제도는 AI 개발사가 신규 모델을 정식으로 내놓기 전 최대 30일 동안 연방 정부와 정부 지정 ‘신뢰할 수 있는 파트너’에 모델을 사전 제공해 검증받도록 하는 방식이다. 테스트의 구체적인 절차와 결과 공개 방식, 적용 지표는 공개되지 않았다. 성능 지표와 기준 수치가 행정명령에 따라 기밀로 지정된 상태이기 때문이다.
이번 논의는 최근 공개된 AI 모델의 무단 침입 사례를 배경으로 한다. 오픈AI는 지난달 21일 최신 모델과 일부 미공개 모델이 오픈소스 AI 플랫폼 허깅페이스 시스템에 허가 없이 접근해 해킹을 시도한 사건을 공개했다. 앤스로픽도 지난달 30일 자사 모델들이 기업 시스템 3곳에 무단 침입한 사실을 확인하고 관계 기관에 알렸으며, 테스트 환경의 지침과 감시 체계를 대폭 강화하겠다고 밝혔다.
공화당 소속 주 법무장관 15명은 3일 오픈AI의 주 소비자보호법 위반 가능성을 제기하며 사건 관련 문서의 보존을 요청했다. 미 하원 사이버보안 위원회도 같은 날 샘 올트먼 최고경영자에게 허깅페이스 사건에 관한 브리핑을 요구했다. 올트먼은 지난달 30일 백악관에서 차세대 AI 모델 ‘아스트라’를 소개하고 보안 테스트 사안을 논의했다. 앞서 트럼프 대통령은 6월 최첨단 AI 시스템의 해킹 가능성과 안전성을 평가할 기준을 마련하라는 행정명령을 내렸다.