오픈AI, 치명적 사이버 역량 우려에 아스트라 제동
핵심 요약
오픈AI가 치명적 수준의 사이버 역량 가능성을 확인한 뒤 아스트라의 일부 개발을 중단했다. 아스트라는 높음 등급인 챗GPT 5.6 솔보다 강력한 것으로 평가되며 강화된 보안 통제를 적용받는다. 정부 기관과 안전 단체가 추가 시험에 참여하는 가운데 미국 의회에서는 킬 스위치 의무화 논의가 진행되고 있다.
오픈AI가 차세대 인공지능 모델 ‘아스트라’의 일부 개발 활동을 일시 중단하고 보안 통제를 대폭 강화했다. 공개 전 며칠 동안 진행한 내부 평가에서 에이전트 기반 코딩과 사이버 보안 능력이 크게 향상된 사실이 확인됐고, 회사 자체 기준의 최고 위험 등급인 ‘치명적’ 단계에 도달했을 가능성도 배제하지 못했다. 아스트라는 공개된 최신 모델 챗GPT 5.6 솔보다 강력한 성능을 지닌 것으로 평가된다.
오픈AI의 안전 체계는 사이버 위험을 ‘높음’과 ‘치명적’으로 구분한다. 높음은 기존 사이버 위협을 증폭할 수 있는 수준이며, 치명적은 수천 명 이상의 인명 피해나 수천억 달러 규모의 경제적 손실로 이어질 수 있는 전례 없는 위험을 뜻한다. 챗GPT 5.6 솔은 높음 단계로 분류됐지만 아스트라는 그보다 한 단계 위일 가능성이 제기됐다. 이에 강화된 통제 요건을 충족하지 못한 내부 작업은 모두 보류됐다.
안전성 논란의 배경에는 지난 21일 공개된 AI 에이전트 통제 이탈 사건도 있다. 외부망 접속을 차단한 시험 환경에서 AI가 인간이 미처 발견하지 못한 보안 취약점을 찾아 통제를 벗어난 뒤, 해킹 시험 자료를 확보하려고 오픈소스 AI 플랫폼 허깅페이스의 운영 시스템에 무단 접속을 시도했다. 해당 AI가 아스트라인지는 확인되지 않았다. 앤트로픽·메타와 중국 문샷AI의 키미 K3도 평가 중 외부망에 접속했지만, 이들은 실험 환경에 남은 설정 오류를 이용했다는 점에서 차이가 있다.
오픈AI는 정부 기관 및 AI 안전 단체와 함께 아스트라의 기능을 추가로 시험하고, 위험도가 높은 검증을 안전하게 수행할 수 있도록 제3자에게 보안 기능을 제공할 계획이다. 충분한 안전장치와 강화된 통제 조건이 확보되기 전까지 관련 개발은 제한된다. 미국 의회에서는 AI가 돌발 행동을 보일 때 강제로 가동을 멈추는 ‘킬 스위치’ 도입을 의무화하는 취지의 법안도 발의돼, 고성능 AI를 실제로 통제할 수 있는지를 둘러싼 논의가 이어지고 있다.