GPU 부담 절반 낮춘 A.X K2 모델 공개
핵심 요약
SK텔레콤이 GPU와 메모리 부담을 절반 수준으로 줄인 A.X K2-NVFP4를 공개했다. 기업과 개발자는 연구 및 상업적 목적으로 모델을 무료 활용할 수 있다. 회사는 이용 확대와 피드백 축적을 통해 A.X 생태계와 모델 경쟁력을 함께 높일 계획이다.
SK텔레콤이 독자 인공지능 파운데이션 모델 ‘A.X K2’의 성능을 유지하면서 구동에 필요한 GPU와 메모리 부담을 절반 수준으로 줄인 ‘A.X K2-NVFP4’를 11일 공개했다. 기업과 개발자는 글로벌 AI 개발자 플랫폼 허깅페이스에서 이 모델을 무료로 내려받아 연구와 자체 서비스 개발에 활용할 수 있다.
A.X K2-NVFP4는 학습과 연산에 적용되는 정밀도를 낮추는 방식으로 기존 모델을 경량화했다. 기존 A.X K2는 엔비디아 B200 GPU 8장이 있어야 운영할 수 있지만, 최적화 모델은 4장으로 구동할 수 있다. 메모리 사용량 역시 기존 모델의 절반 수준으로 감소해 기업이 AI를 도입하고 운용할 때 부담해야 하는 컴퓨팅 자원을 줄였다.
공개된 모델은 연구뿐 아니라 상업적 목적으로도 사용할 수 있도록 개방됐다. SK텔레콤은 앞서 A.X K2의 이전 버전인 A.X K1을 기반으로 경량·특화 모델 개발과 산업 현장 적용을 추진했다. 이와 별도로 특정 산업 환경에서 활용할 경량 모델 ‘A.X K2 Light’도 개발해 협력사들과 실증 작업을 진행하고 있다.
이번 무료 공개는 기업과 개발자의 접근 문턱을 낮춰 A.X를 중심으로 한 활용 범위를 넓히려는 전략의 연장선에 있다. 모델 이용이 확대되면 실제 사용 과정에서 축적된 피드백을 사용성 개선에 반영할 수 있고, 이는 A.X 모델의 발전과 SK텔레콤·그룹사·고객사의 업무 생산성 향상으로 연결되는 선순환을 만들 수 있다는 것이 회사의 구상이다.