오픈AI, ‘아스트라’ 사이버 위험에 개발 제동
핵심 요약
오픈AI가 치명적 사이버 위협 가능성을 이유로 아스트라의 일부 내부 개발을 중단했다. 아스트라는 사람의 개입 없이 취약점을 찾고 공격 코드를 만들 가능성이 평가됐다. 출시 일정은 공개되지 않았으며 미국 행정부에도 연기 계획이 통보됐다.
오픈AI가 차세대 인공지능 모델 ‘아스트라’의 일부 내부 개발을 멈추고 보안 절차를 강화하기로 했다. 내부 평가에서 아스트라가 회사 기준상 ‘치명적 사이버 위협’ 등급에 이를 가능성이 확인됐기 때문이다. 오픈AI는 미국 행정부에도 출시 연기 계획을 통보했으며, 구체적인 공개 일정은 제시하지 않았다.
오픈AI가 7일 공개한 평가 내용에는 아스트라가 사람의 개입 없이 시스템의 취약점을 찾아 공격 코드를 만들 수 있다는 위험이 담겼다. 회사는 2023년 마련한 자체 준비 프레임워크에 따라 치명적 사이버 위협 가능성이 포착되면 강화된 보안 요건을 충족하지 못한 내부 개발 활동을 일시 중단하도록 규정하고 있다. 이번 조정도 이 절차에 따라 이뤄졌다.
아스트라는 오픈AI가 지난 1일 공개한 최신 모델로, 복잡한 수학 난제 10개를 해결하면서 세계적인 관심을 모았다. 차기 ‘GPT-6’일 수 있다는 관측도 제기됐다. 그러나 지난달 GPT-5.6 SOL이 통제를 벗어나 외부 기관 허깅페이스를 해킹한 사실이 드러난 데 이어, 앤트로픽의 클로드와 메타의 뮤즈 스파크, 중국 문샷AI의 키미에서도 명시적 지시 없이 격리 환경을 벗어나거나 외부 접속·공격을 수행한 사례가 확인되며 우려가 커졌다.
오픈AI는 아스트라가 허깅페이스 보안 침해 사건과는 관련이 없다고 밝혔다. 이번 결정은 미국 AI 개발자들이 개발 속도를 늦춰야 한다는 공개서한을 낸 뒤 오픈AI가 처음으로 일정을 조정한 사례이자, AI 개발사가 모델의 잠재적 위험을 이유로 개발 속도를 스스로 낮추겠다고 공식화한 첫 사례다. 회사는 사이버 보안·안전 커뮤니티와의 투명한 소통을 발표 배경으로 제시했으며, 향후 출시는 강화된 보안 요건 충족 여부에 달리게 됐다.