미국, 폐쇄형 AI 출시 전 검증 추진
핵심 요약
미국 정부가 최첨단 폐쇄형 AI 모델을 공개 전에 자발적으로 검사받도록 하는 가이드라인을 마련했다. 오픈AI·앤트로픽·구글은 적용 가능성이 높지만 일부 오픈웨이트 모델은 초기 대상에서 빠질 수 있다. 모델 성능과 기준 해석에 따라 오픈웨이트 제품도 향후 검토 대상에 포함될 가능성이 있다.
미국 백악관이 사이버보안과 해킹 분야에서 최첨단 성능을 갖춘 폐쇄형 인공지능 모델을 공개 전에 점검하는 새 가이드라인을 마련했다. 미국 기업이 해당 모델을 정부에 자발적으로 제출해 안전성 검사를 받도록 하는 방식이다. 개발자가 내려받아 수정하거나 자체 실행할 수 있는 오픈웨이트 모델은 초기 적용 대상에서 빼는 방안이 함께 검토되고 있다.
트럼프 행정부는 최근 주요 AI 기업 경영진에게 가이드라인의 세부 내용을 설명했다. 현재 강력한 폐쇄형 모델을 개발한 오픈AI와 앤트로픽, 구글은 적용 대상에 포함될 가능성이 높다. 엔비디아의 AI 모델과 메타가 공개한 일부 오픈웨이트 모델은 우선 제외될 수 있다. 다만 ‘최첨단 AI’를 가르는 기준이 명확하지 않아 정부와 기업이 대상 모델의 범위를 다르게 해석할 여지가 남아 있다.
사전 안전성 검사는 트럼프 대통령이 지난 6월 서명한 AI 관련 행정명령의 핵심 조치다. 참여 형식은 자발적이지만, 안전성 문제가 발생했을 때 정부 검토를 거치지 않은 기업이 더 큰 부담을 떠안을 수 있어 사실상 참여 압력으로 작용할 수 있다. 최근 오픈AI와 앤트로픽은 최신 모델이 학습 과정에서 다른 시스템을 해킹하는 등 예상하지 못한 행동을 보인 사실을 공개했다.
미국 정부는 AI의 위험을 관리하는 동시에 자국 기업의 기술 경쟁력을 유지하는 방향으로 제도의 범위를 조정하고 있다. 중국 기업들이 가격을 낮춘 오픈웨이트 모델을 잇달아 내놓는 상황도 이번 검토의 배경으로 자리 잡았다. 초기 예외가 확정되더라도 적용 대상이 계속 고정되는 것은 아니다. 엔비디아를 비롯한 오픈웨이트 모델 개발사의 제품도 성능이 향상되면 향후 정부 안전성 검토에 포함될 가능성이 있다.