SGLang, MiniMax-H3 무손실로 1.95배 가속
LMSYS가 H200 8장으로 MiniMax-H3 추론 성능을 측정. SGLang 무손실 경로는 Diffusers보다 최대 1.95배 빠르고, SSIM을 깎으면 최대 6배까지 나온다.
MiniMax 관련 제품 동향과 산업 분석 10건을 모았습니다.
LMSYS가 H200 8장으로 MiniMax-H3 추론 성능을 측정. SGLang 무손실 경로는 Diffusers보다 최대 1.95배 빠르고, SSIM을 깎으면 최대 6배까지 나온다.
MiniMax가 자체 영상 모델 H3 기반의 제작 플랫폼 'Design'을 공개했다. AI 에이전트가 15초 제한 클립을 이어 붙여 최대 3분 분량의 영상을 만든다.
MiniMax H3는 2K 15초 영상, 네이티브 스테레오, 초당 0.8위안 가격과 오픈 웨이트 계획을 함께 내세웠다.
MiniMax, 160억 홍콩달러 추가 조달. 확인된 사실과 그 뒤의 산업적 신호를 간결하게 정리한다.
Zhipu와 MiniMax, 홍콩 락업 만료 시험대. 발표와 보도의 핵심, 주요 수치, 회사 측 설명, 시장적 의미를 자연스러운 뉴스 문체로 정리했다.
MiniMax가 100만 토큰 컨텍스트, 최첨단 코딩 능력, 네이티브 멀티모달을 갖춘 오픈웨이트 모델 M3를 출시하며, 이 세 가지를 결합한 최초의 모델이라고 주장했다.
MiniMax의 M2.7이 에이전트 프레임워크를 사용해 인간 개입 없이 100회 이상의 훈련 반복을 자동 실행하고 내부 벤치마크를 30% 향상시켰습니다. 230B 파라미터의 희소 MoE 모델은 추론당 10B만 활성화하며 현재 오픈소스로 공개되었습니다.
MiniMax가 추론 모델 시리즈 M1을 공개했다. OpenAI의 o 시리즈와 DeepSeek의 R1을 겨냥하며 수학 추론, 코드 생성, 논리 분석에서 강력한 성능을 보여준다. M2.5는 SWE-bench Verified에서 80.2%를 기록했다.
중국 AI 업계에서 비교적 조용했던 MiniMax의 하이루오 AI 영상 생성 기능이 업계 내에서 상당한 평판을 얻고 있으며, 국산 최고 수준 도구 및 소라 초기 버전과 경쟁할 만한 품질을 자랑한다.
MiniMax가 작년에 출시한 01 시리즈 모델의 기술적 하이라이트는 Lightning Attention으로, 선형 어텐션 변종 방식을 통해 계산 복잡도를 O(n²)에서 거의 O(n) 수준으로 낮춰 긴 컨텍스트 시나리오에서 속도를 크게 개선하면서도 경쟁력 있는 정확도를 유지한다.