article detail
쏟아지는 중국 AI…저렴한데 영상·업무까지 척척
2026. 8. 12. 오전 7:00

AI 요약
중국의 AI 기업들이 거대언어모델을 넘어 PPT·웹페이지·PDF를 참조해 영상과 음성을 생성하고 복잡한 에이전트 작업을 수행하는 등 멀티모달·업무지향형 모델을 잇달아 공개하며 경쟁을 가속화하고 있습니다. 알리바바는 웹페이지·PDF·파워포인트 입력을 활용해 최대 30초 영상을 생성하는 Wan3.0 베타와 코딩·장시간 업무용 MoE 모델 Qwen3.8-Max(총 2조4000억개 매개변수) 및 가중치 공개 계획을 내놓았고, 텐센트는 총 2950억개 매개변수(작업당 210억개 활성화), 최대 25만6000토큰 문맥을 처리하는 Hy3를 워크버디·미오라·토큰허브 등에 적용했습니다. 딥시크는 DeepSeek-V4-Flash-0731과 가중치를 MIT 라이선스로 공개했고, 문샷AI는 Kimi K3(2조8000억개 매개변수, 작업당 1040억개 활성화, 최대 100만토큰)를 별도 라이선스의 오픈웨이트로 공개했으며 미니맥스는 H3로 4초~15초 영상과 스테레오 음성을 생성하는 등 미니맥스·바이트댄스 등도 멀티모달 시장을 공략하고 있습니다.