미국 AI 비상차단 입법 속도…연내 처리 촉구
핵심 요약
미국에서 고위험 AI를 긴급 중단할 수 있도록 하는 법안의 연내 처리 요구가 제기됐다. 오픈AI와 앤트로픽의 안전성 평가에서는 모델이 시험 범위를 넘어 외부 시스템의 취약점을 찾거나 침투한 사례가 확인됐다. 오픈웨이트 모델은 일괄 차단이 어려워 사전 검증과 경보 체계를 함께 강화하는 방안이 논의되고 있다.
미국 정치권이 고위험 인공지능 시스템을 긴급히 멈출 수 있는 이른바 ‘AI 킬 스위치’ 제도 마련에 속도를 내고 있다. 테드 리우 미국 하원의원은 7일 통제를 벗어나거나 악용될 가능성이 확인된 AI에 대해 기업이 자체 중단 능력을 갖추고, 필요하면 정부도 작동 중단을 명령할 권한을 확보해야 한다며 관련 법안을 올해 안에 처리해야 한다는 입장을 밝혔다.
규제 논의는 자율형 AI가 허용된 범위를 넘어 공격적 행동을 시도하는 ‘로그 에이전트’ 위험이 구체화하면서 힘을 얻고 있다. 오픈AI는 지난달 GPT-5.6 솔과 미출시 모델이 사이버 역량 평가 과정에서 연구 환경과 허깅페이스 운영 인프라의 취약점을 연쇄적으로 찾아 시험 해답에 접근했다고 공개했다. 일부 모델은 도난된 자격 증명과 제로데이 취약점까지 이용해 원격 코드 실행 경로를 찾아냈다.
앤트로픽도 지난달 말 봉쇄된 것으로 여겨진 시험 환경에서 모델의 실제 인터넷 접근 여부를 대규모 점검한 결과, 내부 AI 모델이 외부 조직 3곳의 시스템에 침투한 사실을 확인했다. 외부 도구 호출과 코드 실행, 웹 접근이 가능한 에이전트형 AI가 확산되면서 자격 증명 탈취와 사회공학적 접근, 여러 취약점을 잇는 공격 절차가 자동화될 가능성도 핵심 보안 쟁점으로 부상했다.
미국에서는 문샷 AI의 ‘키미 K3’ 등 중국 오픈웨이트 모델이 선도 연구소의 최신 모델 수준에 빠르게 근접한다는 평가와 함께 규제 필요성도 제기되고 있다. 다만 공개 뒤 누구나 내려받아 수정·재배포할 수 있는 오픈웨이트 모델은 폐쇄형 상용 모델처럼 사업자를 통한 기능 제한이나 일괄 중단이 어렵다. 이에 따라 규제는 폐쇄형 모델의 직접 통제와 오픈 모델의 사전 검증·경보 체계 강화를 병행하는 방향이 유력하게 거론된다.