독자 AI 4개 모델, 국민 평가서 기술력 겨룬다
핵심 요약
독자 AI 모델 2차 평가에 국내 네 팀이 참여했다. 일반 국민 200명이 나흘 동안 모델의 실제 활용성을 평가한다. 정부는 이달 세 팀으로 압축하고 연내 최종 두 모델을 선발한다.
국내 기술로 개발한 독자 인공지능 모델을 선발하는 2차 평가가 시작됐다. SK텔레콤과 LG AI연구원, 업스테이지, 모티프테크놀로지스 등 네 팀이 참여했으며, 성능 지표뿐 아니라 전문가 검증과 실제 사용 편의성을 함께 평가받는다. 일반 국민 200명도 8일부터 나흘 동안 네 모델을 직접 사용한 뒤 점수를 매긴다.
SK텔레콤 모델은 글과 이미지에 더해 음성까지 처리하며 자연스러운 대화를 이어가는 데 강점을 보였다. 이용자가 대화 중 끼어들면 답변을 멈추고 다시 들으며, 운동 계획 수립이나 음식 주문도 말로 처리한다. LG AI연구원 챗봇은 300쪽이 넘는 세제 개편안 한글 파일에서 1주택자 관련 내용을 찾아 개편 전후를 표로 정리했다. 추가 질문을 제안하고 이용자가 원하는 방식에 맞춰 설명을 바꾸는 기능도 구현했다.
업스테이지 모델에 지뢰 찾기 게임을 만들어 달라는 문장 한 줄을 입력하자 27초 만에 실행 가능한 결과물이 나왔다. 개인 클라우드 계정을 연결한 뒤에는 필요한 조건을 이용자에게 확인하고 가계부까지 완성했다. 추가 모집을 통해 평가에 합류한 모티프테크놀로지스는 20여 명의 개발진이 정부가 제공한 제한된 장비로 AI 구조 전체를 자체 기술로 구축했다.
모티프테크놀로지스 모델은 여행 정보를 수집해 일정을 구성하거나 프로그램 코드를 작성하는 작업을 상대적으로 적은 연산으로 수행하는 데 초점을 맞췄다. 이번 평가는 각 모델의 벤치마크 성능과 전문가 판단, 국민이 체감하는 활용성을 종합해 진행된다. 정부는 이달 안에 네 팀을 세 팀으로 줄인 뒤 연내 한 차례 추가 평가를 실시해 최종 두 개 모델을 선발할 계획이다.