국내 AI 42종 평가에도 출시 전 검증은 0건
핵심 요약
한국에는 AI 모델을 출시 전에 정부가 검증할 제도와 절차가 없다. AI안전연구소가 평가한 국내외 모델 42종 가운데 사전평가 사례는 한 건도 없었다. 미국과 영국은 미공개 고성능 모델의 사이버 공격 능력을 출시 전에 시험하고 있다.
한국에서 인공지능 모델을 출시 전에 검증하는 제도와 절차가 마련되지 않은 것으로 확인됐다. AI안전연구소가 지금까지 국내외 AI 모델 42종을 평가했지만, 공개 전에 안전성을 살핀 사례는 한 건도 없었다. 기업이 미공개 모델의 접근권을 정부에 제공하고 해킹 능력 등 위험 요소를 점검받을 법적·제도적 통로도 현재 없다.
AI안전연구소의 평가 범위에는 공격형 사이버 분야가 포함된다. 다만 모든 평가는 모델이 시장에 나온 뒤 이뤄졌다. 미국에서는 오픈AI·앤트로픽·구글 딥마인드·마이크로소프트·xAI 등 5개사가 미 상무부 산하 AI표준혁신센터의 출시 전 평가에 참여하고 있어 국내 체계와 차이를 보인다.
백악관은 지난 4일 현지시간 오픈AI·구글·앤트로픽·메타 실무진과 고성능 AI 모델의 자율 사이버보안 평가 방안을 논의했다. 국가안보 위험이 큰 폐쇄형 최첨단 모델을 외부에 공개하기 전 정부 평가팀에 최대 30일간 접근권을 주고 사이버 공격 능력을 시험하는 방안이 제시됐다. 가중치를 공개하는 메타의 라마 같은 오픈웨이트 모델은 대상에서 빼는 방향도 다뤄졌다.
영국 AI보안연구소는 오픈AI의 최신 모델을 공개 전에 받아 32단계 모의 기업망에서 시험했다. 사이버보안 전문가가 약 20시간을 들일 것으로 추정한 공격을 해당 AI는 10번 가운데 2번 완주했다. 출시 후 평가 공개 실적은 한국이 상대적으로 많다. 영국은 미국과 공동 수행한 2건만 공개했고 일본·싱가포르·EU·캐나다·프랑스·호주는 공개 사례가 없으며, 한국 AI안전연구소는 카카오 카나나 평가 결과를 공개했다. 과학기술정보통신부는 미국식 사전평가 도입 여부에는 답하지 않았다.