중국 AI, 영상 제작부터 기업 업무까지 확장
핵심 요약
중국 AI 기업들이 공개 가중치와 낮은 비용을 기반으로 영상·코딩·기업 업무 시장을 넓히고 있다. 알리바바와 텐센트는 생성형 AI를 콘텐츠 제작과 업무 플랫폼에 직접 연결했다. 문샷AI·미니맥스·바이트댄스는 장문 처리와 영상·음성 멀티모달 기능으로 경쟁에 합류했다.
중국 인공지능 기업들이 공개 가중치와 낮은 이용 비용을 앞세워 개발자를 확보하는 동시에 영상 제작, 코딩, 디자인, 기업 업무로 서비스 영역을 넓히고 있다. 알리바바와 텐센트가 자체 모델을 실무 도구에 연결한 가운데 딥시크, 문샷AI, 미니맥스, 바이트댄스도 고성능·멀티모달 모델을 잇달아 내놓으며 경쟁에 가세했다.
알리바바의 Wan3.0은 텍스트와 이미지, 기존 영상, 음성은 물론 웹페이지와 PDF, 파워포인트 자료까지 참고해 마케팅·교육·소셜미디어용 영상을 최대 30초 분량으로 만든다. 요청에 맞춰 길이를 추천하고 장면을 연장하는 기능도 제공한다. 공개 베타여서 생성 속도와 비용, 장면의 시각적 일관성은 추가 검증이 필요하다. 이달 초 공개된 Qwen3.8-Max는 총 2조4000억개 매개변수의 전문가혼합 모델이며, 알리바바는 처음으로 Max급 모델 가중치를 공개할 계획이다.
텐센트의 Hy3는 총 2950억개 매개변수 중 작업마다 210억개를 활성화하고 최대 25만6000토큰을 처리한다. 빠른 응답과 심층 추론을 함께 지원하며 코딩, 문서 처리, 금융 분석, 디자인, 게임 제작에 초점을 맞췄다. 자료 조사와 문서·프레젠테이션 작성을 수행하는 워크버디, 편집 가능한 그래픽·영상·3D·사용자 인터페이스를 만드는 미오라, 비용과 작업에 맞춰 모델을 연결하는 토큰허브에 적용됐다. 출시 첫 주 API 호출은 이전 세대보다 68배 늘었고 오픈라우터 이용량 1위에 올랐지만, 카페24 등과 추진하는 국내 협력의 실제 도입 사례는 공개되지 않았다.
문샷AI가 지난달 27일 가중치를 공개한 Kimi K3는 총 2조8000억개 매개변수 가운데 작업마다 1040억개를 사용하고, 텍스트·이미지·영상을 이해하며 최대 100만토큰을 처리한다. 별도 라이선스가 적용되는 오픈웨이트 모델이다. 미니맥스가 지난 3일 공개한 H3는 4~15초 영상과 스테레오 음성을 동시에 생성하지만 한국에서 직접 실행하거나 수정·배포하려면 별도 허가가 필요하다. 바이트댄스가 지난 5일 선보인 SeedRealtime은 표정과 동작, 주변 소음, 대화 흐름을 살펴 응답 시점을 판단하며 화상 상담, AI 튜터, 디지털 휴먼을 주요 대상으로 삼았다.