엑사원, 산업 데이터 예측 성능 세계 선두
핵심 요약
엑사원이 표 데이터와 시계열 데이터 예측 평가에서 세계 정상급 성능을 기록했다. LG AI연구원은 하반기 제조·금융·바이오·헬스케어 분야에서 개념검증과 사업화를 추진한다. 7500억 매개변수의 K-엑사원 2.0과 산업 특화 역량을 독파모 2차 평가에 내세운다.
LG AI연구원이 개발한 산업 특화 인공지능 모델 ‘엑사원’이 표 데이터와 시계열 데이터 예측 평가에서 세계 정상급 성능을 확인했다. 연구원은 올해 하반기부터 금융·제조·바이오·헬스케어 현장을 대상으로 모델 적용을 본격화하고, 실제 업무 효율을 높인 실증 결과를 독자 AI 파운데이션 모델 프로젝트 2차 단계평가의 경쟁력으로 제시할 계획이다.
정형 데이터 파운데이션 모델인 ‘엑사원 태뷸러’는 글로벌 리더보드 탭아레나의 범주형 데이터 예측 부문에서 종합 1위를 차지했다. 평가 점수는 1760점으로, 구글이 지난 7월 공개한 탭FM의 1749점을 앞섰다. 이 모델은 표를 텍스트로 바꾸지 않고 행과 열의 구조, 데이터 사이의 관계를 직접 파악한다. 데이터가 적어도 새로운 문제에 빠르게 적응하며, 새 데이터가 들어올 때마다 모델 전체를 다시 학습하지 않아도 된다.
LG AI연구원은 하반기에 제조와 금융, 바이오·헬스케어 등 3개 분야에서 엑사원 태뷸러의 개념검증을 진행한 뒤 실제 사업으로 연결할 방침이다. 금융 분야에서는 데이터를 분석해 연체와 부도, 이상 거래의 발생 가능성을 예측하는 방식으로 활용할 수 있다. 시계열 예측 모델 ‘엑사원 포캐스트’도 처음 접한 분야를 추가 학습 없이 분석하는 제로샷 부문에서 구글과 알리바바 모델을 제치고 1위에 올랐으며, 에이전틱 AI 부문에서는 2위를 기록했다.
엑사원 포캐스트는 산업별 시계열 데이터와 현실 세계를 모사한 2조 개 규모의 가상 시계열 데이터를 학습했다. 산업마다 별도 모델을 반복 개발하던 방식과 달리 하나의 모델로 관측 경험이 없는 변화까지 포착해 폭넓게 적용할 수 있도록 설계됐다. LG AI연구원은 최신 글로벌 모델을 웃도는 벤치마크 성능과 산업 특화 역량, 개방성을 독파모 평가에서 부각할 계획이다. K-엑사원 2.0의 매개변수는 7500억 개로, 2360억 개였던 1차 모델보다 3배 이상 늘었다.