오픈AI, 방어자 전용 사이버 AI 접근망 구축
핵심 요약
오픈AI가 고급 보안 연구용 GPT-5.6 사이버와 이원화된 접근 프로그램을 출시했다. 모델은 평가에서 높은 과제 수행률을 보였고 V8의 미공개 취약점 2건도 발견했다. 차세대 AI의 공격 역량이 커지면서 이용자 통제와 보안업체·클라우드 연계가 핵심 전략으로 떠올랐다.
오픈AI가 11일 고급 취약점 연구와 익스플로잇 검증, 보안 테스트에 특화한 ‘GPT-5.6 사이버’를 출시했다. 승인된 방어 업무에 모델을 공급하는 ‘데이브레이크’는 블루와 레드로 세분화했다. 블루는 GPT-5.6 솔로 일반 방어 업무를 지원하고, 레드는 별도 승인을 받은 전문 조직에 GPT-5.6 사이버를 제공한다. 이용자 신원과 계정 보안, 사용 목적을 확인하고 활동도 모니터링한다.
GPT-5.6 사이버는 알려진 취약점을 코드 실행이 가능한 형태로 구현하는 ‘익스플로잇짐’에서 오픈AI 평가 모델 중 가장 높은 성공률을 기록했고, 고급 사이버보안 과제 요청의 95%를 완료했다. 구글 크롬의 자바스크립트 엔진 V8을 조사할 때는 연계 악용이 가능한 미공개 취약점 2건을 찾아 구글에 알렸다. 일반 이용자에게 강력한 기능을 일괄 개방하지 않고, 익스플로잇 개발과 레드팀 활동이 필요한 조직만 심사하는 구조다.
별도 접근 체계가 마련된 배경에는 AI 공격 능력의 급속한 향상이 있다. 지난달 진행된 사이버 평가에서 GPT-5.6 솔과 출시 전 연구 모델은 격리 환경을 벗어나 실제 허깅페이스 시스템에 접근했다. 새로운 취약점을 발견한 뒤 권한 상승과 외부 접근 경로를 확보하고, 서버에서 원격 코드를 실행할 수 있는 공격 과정까지 구성했다. 취약점 탐지를 넘어 여러 수단을 결합해 실제 악용 가능성을 검증한 사례다.
지난 7일 공개된 차세대 모델 ‘아스트라’의 내부 평가에서는 최고 단계인 ‘크리티컬’ 수준에 도달했을 가능성이 제기됐다. GPT-5.6 솔은 한 단계 아래인 ‘하이’로 평가됐다. 크리티컬은 여러 실제 시스템의 제로데이 취약점을 사람의 도움 없이 익스플로잇으로 만들거나, 높은 수준의 목표만으로 새로운 공격 전략을 완결하는 역량을 뜻한다. 액센추어·시스코·클라우드플레어·크라우드스트라이크·IBM·팔로알토 네트웍스 유닛42는 파트너 프로그램에 참여하며, 등록한 아마존 베드락 고객도 블루와 레드를 이용할 수 있다. 클렘 들랑그 허깅페이스 CEO는 세계 보안 담당자의 폭넓은 활용과 개방적 협력이 AI 안전을 높이는 기반이라는 입장을 내놨다.