MiniMax 하이루오 AI, 영상 생성 분야 국산 다크호스로 부상

MiniMax는 중국 AI 업계에서 비교적 조용한 기업이지만, 하이루오 AI의 영상 생성 능력은 업계 내에서 상당한 입지를 다지고 있다.

제품 형태

하이루오 AI는 MiniMax의 소비자 대상 제품으로, 텍스트 대화, 음성 합성, 영상 생성을 포괄한다. 그중 영상 생성이 가장 뛰어난 기능이다.

사용자는 텍스트 설명을 통해 짧은 영상을 생성할 수 있으며, 스타일은 사실적, 애니메이션, 예술 등 다양한 유형을 지원한다. 생성 품질은 국산 도구 중 최상위권이며, 일부 시나리오에서는 소라 초기 버전과 견줄 수 있다.

기술 기반

영상 생성 뒤에는 MiniMax가 자체 개발한 멀티모달 기반 모델이 있다. 소라와 유사하게 확산 모델(Diffusion) + 시계열 모델링 방식을 채택하고 있다.

MiniMax의 특징은 다음과 같다:

  • 중국어 맥락 이해가 더 정확함 (중국어 프롬프트를 영어로 번역하지 않고 생성 가능)
  • 캐릭터 일관성이 우수함 (영상 내에서 캐릭터의 외형이 변하지 않음)
  • 유사 제품 대비 생성 속도가 빠름

영상 생성 분야 구도

이 분야에는 현재 절대적인 승자가 없다:

  • 소라 (OpenAI): 인지도는 가장 높지만, 상업화 경로는 험난함
  • 클링 (Kuaishou): 중국 내 사용량이 가장 많을 가능성
  • Runway: 해외 크리에이터들이 많이 사용
  • 하이루오 AI: 품질과 사용자 경험에서 빠르게 추격 중

영상 생성은 텍스트 생성과 달리 사용자의 '적당히 괜찮은' 수준에 대한 허용도가 훨씬 낮다. 손가락이 하나 더 있거나 물체가 갑자기 사라지면 영상 전체가 망가진다. 이는 모델의 물리 세계 이해 능력시계열 일관성에 매우 높은 요구를 부과한다.

MiniMax의 전략은 멀티모달 병행이다——텍스트, 음성, 영상에 통합된 기본 아키텍처를 사용하여 서로 다른 모달 간의 이해를 상호 강화하는 방식이다. 이 접근 방식은 장기적으로 영상 모델만 단독으로 구축하는 것보다 더 큰 이점을 제공할 수 있다.

출처: MiniMax 공식 제품 페이지, CocoLoop, 36Kr 보도