AI 권한·위험도 한눈에 보는 4축 등급 제안
핵심 요약
AI의 자율성·영향력·목표 복잡성·범용성을 6단계로 표시하는 평가 체계가 제안됐다. 챗GPT-3.5와 알파고, 클로드 3.5 소네트, 웨이모는 기능과 행동 범위에 따라 서로 다른 등급을 받았다. 규제 활용을 위해 객관적 측정 표준과 자동 안전장치, 사고 책임 기준을 마련해야 한다.
미국 카네기멜런대와 구글 딥마인드 연구진이 13일 국제학술지 ‘네이처’에 인공지능의 행동 범위와 위험 특성을 네 가지 축으로 표시하는 ‘에이전틱 프로필’을 제안했다. AI를 지능 수준만으로 평가하지 않고 자율성, 영향력, 목표 복잡성, 범용성을 각각 0~5의 6단계로 구분해 일종의 신분증처럼 활용하자는 구상이다.
자율성은 사람의 단계별 지시 없이 독립적으로 행동하는 정도, 영향력은 실제 환경을 직접 바꾸는 능력을 뜻한다. 목표 복잡성은 여러 단계의 작업을 나누고 순서를 정해 수행하는 수준이며, 범용성은 다양한 분야의 임무를 처리할 수 있는지를 나타낸다. 종목 추천에 그치는 AI와 실제 주식 매매까지 실행하는 AI를 영향력 측면에서 구별하는 방식이다.
비교 결과 알파고는 자율성 A3을 받았지만 가상 바둑판에 활동이 제한돼 영향력과 범용성이 각각 E1, G1로 평가됐다. 챗GPT-3.5는 정보 제공·번역·조언·코딩을 처리해 G3였으나 질문을 받아야 작동하고 인터넷이나 현실 환경에서 스스로 행동하지 못해 A2에 머물렀다. 외부 도구와 브라우저를 다룰 수 있는 클로드 3.5 소네트는 A3·E3·GC4를 받았다. 운전에 특화된 웨이모는 G2였지만 자율성과 영향력은 각각 A4·E4, 목표 복잡성은 GC4로 비교 대상 중 높은 수준을 보였다.
같은 AI도 브라우저 접근이나 기억·추론 기능이 추가되면 프로필이 달라질 수 있다. 추론 강화는 자율성과 목표 복잡성을, 장기 기억은 연속 행동 수행 능력과 목표 복잡성을 높일 수 있기 때문이다. 연구진은 고급 AI 에이전트에 강제 중단 조건과 자동 차단 장치, 작업 기간에만 허용하는 최소 도구 권한, 이상 행동 때 외부 접근을 끊는 실시간 감시가 필요하다고 제시했다. 실제 규제에 적용하려면 객관적인 측정 지표와 표준을 마련하고 사고 발생 시 개발자·운영자·플랫폼 사업자의 책임 범위도 분명히 해야 한다.