엔비디아, 초대형 AI 모델로 GPU 생태계 확장
핵심 요약
엔비디아가 매개변수 1조개 이상의 오픈웨이트 모델 네모트론4를 개발하고 있다. 매개변수 300억개 규모의 경량 모델 네모트론3.5 라이트닝도 공개했다. 오픈 모델과 데이터센터 생태계를 함께 확대해 GPU 수요 기반을 넓히고 있다.
엔비디아가 매개변수 1조개 이상을 탑재한 차세대 오픈웨이트 인공지능 모델 ‘네모트론4’를 개발하고 있다. AI 칩뿐 아니라 이용자가 직접 내려받아 활용할 수 있는 모델까지 공급해 소수 대형 고객에게 집중된 그래픽처리장치 수요의 저변을 넓히려는 행보로 풀이된다. 개발은 이르면 올해 늦가을 마무리될 수 있다.
네모트론4는 지난 6월 공개된 ‘네모트론3 울트라’보다 약 두 배 큰 규모로 설계되고 있으며, 세계 최고 수준의 오픈소스 AI 모델을 목표로 한다. 오픈웨이트는 학습을 마친 모델의 가중치인 파라미터를 공개해 이용자가 목적에 맞게 내려받아 쓸 수 있도록 하는 방식이다. 다만 네모트론3 울트라는 현재 성능 평가에서 미국 오픈소스 모델 가운데 2위에 머물렀고, 전체 순위에서는 상위 40위권 밖에 자리해 중국 최상위 모델과 상당한 격차를 보이고 있다.
엔비디아는 12일 매개변수 300억개 규모의 경량 모델 ‘네모트론3.5 라이트닝’도 별도로 공개했다. 이 모델에는 대형 모델이 갖춘 능력을 더 작은 모델로 옮기는 ‘증류’ 기법이 적용됐다. 초대형 모델 개발과 경량 모델 공급을 함께 추진하면서 이용 목적과 구동 환경이 다른 수요층을 아우르는 자체 AI 모델 제품군을 확대하는 모습이다.
오픈 모델의 확산은 엔비디아의 하드웨어와 데이터센터 사업을 뒷받침하는 구조와 맞닿아 있다. 무료로 공개된 모델도 실제 구동 과정에서는 GPU가 필요하기 때문에 이용자가 늘어날수록 관련 인프라 수요도 커질 수 있다는 판단이다. 엔비디아는 하드웨어와 소프트웨어를 포괄하는 생태계 구축에 힘을 싣는 한편, 월가 대형 금융회사들과 5000억 달러, 약 710조원 이상의 자금을 AI 인프라에 동원하기로 하며 데이터센터 구축 지원에도 속도를 내고 있다.