A.X K2, 국제 수학평가서 금메달 기준 도달
핵심 요약
A.X K2가 IMO 2026 문제 평가에서 금메달 기준과 같은 29점을 기록했다. MathArena AIME 2026에서는 정확도 97.1%로 잉클링과 공동 1위에 올랐다. SK텔레콤은 6880억개 규모 모델을 바탕으로 생활·산업 분야의 AI 전환을 추진한다.
SK텔레콤의 초거대언어모델 ‘에이닷엑스 K2(A.X K2)’가 국제수학올림피아드(IMO) 2026 문제 평가에서 금메달 기준과 같은 점수를 받았다. 6개 문제를 대상으로 한 평가에서 42점 만점에 29점을 기록해 올해 금메달 기준선인 29점에 도달했다. 허깅페이스의 ‘MathArena AIME 2026’ 리더보드에서도 97.1%의 정확도로 공동 최고점을 차지했다.
A.X K2는 IMO 2025 기출문제 평가에서도 42점 만점에 35점을 획득했고, 한국수학올림피아드(KMO) 2026 2차 문제에서는 만점을 기록했다. 지난해 IMO 평가에서는 구글 딥마인드의 ‘제미나이 딥 씽크’와 오픈AI 모델이 각각 당시 금메달 기준선인 35점에 올랐다. 올해는 중국 샤오홍슈의 ‘dots-note-3.0’이 42점 만점을 받았으며, SK텔레콤이 파악한 범위에서 미국과 중국 이외 지역 모델 중 올해 금메달 기준을 충족한 사례는 A.X K2가 유일하다.
MathArena AIME 2026은 고난도 수학 추론과 문제 해결 능력을 측정하는 평가로, 2026년 AIME 문제를 바탕으로 공개된 30개 문항의 최종 답 정확도를 비교한다. AIME는 미국수학올림피아드 선발 과정에 활용되는 수학 시험이다. A.X K2가 기록한 97.1%는 오픈AI 최고기술책임자 출신 미라 무라티가 세운 싱킹 머신스 랩의 개방형 AI 모델 ‘잉클링’과 같은 공동 1위 성적이다.
지난달 29일 공개된 A.X K2는 6880억개 매개변수 규모로, 직전 모델인 5190억개 규모의 A.X K1보다 몸집을 키웠다. SK텔레콤은 새 모델에서 수학·과학 추론 능력과 한국 지식, 장문 추론 역량을 강화했으며 국민 생활과 산업 현장의 AI 전환을 지원할 계획이다. 과학기술정보통신부의 ‘모두의 AI’ 사업에도 참여해 모델과 서비스, 인프라를 아우르는 풀스택 AI 역량을 기반으로 체감형 AI 서비스 확산을 추진한다.