MiniMax在8月20日推出MiniMax Design,這是一個以自研影片模型H3為核心打造的多模態創作平台。使用者只要用自然語言講清楚想要什麼,系統就會自動拆解腳本、排列分鏡、生成關鍵影格、產出影片、配樂、加字幕、進行剪輯,一路做到成片。
產品由幾個部分組成:工作流程畫布、3D導演台、素材中心、Skills資源庫,以及一組分工合作的Agent。畫布會把素材與鏡頭之間的關係留在畫面上,改一處不必整個推翻重來,也可以拉出新版本繼續進行。3D導演台的做法更直接——在三維場景裡擺放角色、調整運鏡位置與姿勢,搭建出來的畫面就是分鏡參考,再交給模型生成。Skills資源庫裡有現成的風格範本,像是紙拼貼、水墨、動漫科普這類,也能透過對話當場做出一個自訂Skill。素材會自動存到本機,也能一鍵存進素材中心。ComfyUI的工作流程可以直接匯入使用。
15秒和3分鐘之間差了什麼
H3單次生成的上限是15秒。MiniMax公開的案例裡有42秒的短故事、1分鐘的MV,還有3分鐘的紀錄片。粗略算一下,3分鐘代表至少要把十幾個鏡頭首尾串接起來,每個鏡頭裡人物的長相、服裝、光線、運鏡語言都得對得上,還要按敘事順序排進同一條時間軸。
這正是Design真正想解決的問題。過去一年AI影片的進步大多集中在單一鏡頭的品質上——解析度提高了、物理表現更合理了、人物的手也不再長出六根手指。但要把十幾個單獨的鏡頭拼成一部看得下去的完整作品,靠的是另一套本事:角色一致性、風格統一、時間軸的組織,以及改到第五版都不會走鐘。MiniMax的分工方式是讓H3只負責鏡頭生成,Agent負責統一風格、組織時間軸,Harness則在關鍵節點回頭確認核心方向是什麼,背後再呼叫專業知識庫進行多輪品質檢核。
這套架構跟現在AI寫程式工具的路數幾乎是同一個模子刻出來的:底層模型負責單點產出,上面再疊一層能規劃、能自我檢查、也能被人打斷的協調層。只是影片這邊的變數更多——一個鏡頭出錯,後面全部都得跟著改,所以驗證這一關被提前得更前面。
搶的是誰的飯碗
MiniMax給出的目標場景很明確:短劇全流程製作、電商大量產製商品圖與影片、品牌TVC、宣傳素材、知識型影片、PV/MV。這幾類的共同點是量大、時程緊、單支預算不高,恰好是最容易被工具鏈效率輾過去的一群。
愛范兒的說法是,H3加上Design已經切進了Adobe長期把持的專業創作工作流程。這話只對了一半。專業剪輯師的核心資產從來不只是軟體功能,還包括對素材的判斷力,以及與客戶溝通的能力,這部分短期內Agent還接不走。但專案底層那些重複性工作——找參考、排分鏡、大量產圖、對軌、加字幕——一旦被打包成一句話就能觸發的流程,一個人同時能開的專案數量就會不一樣。業界常說「AI讓內容成本降到十分之一」,降的主要就是這一段。
MiniMax的連續動作
把時間軸往前拉一遍會看得更清楚。先是把影片模型H3開源釋出,讓生成能力大範圍鋪開;接著海螺AI在消費端跑出國產影片生成的使用量;現在Design把這兩端接起來,做成一個以專案為單位的工作台。開源換來的是生態系,消費端換來的是資料,專業端換來的是營收,三條路線是配合著走的。
對中國大陸的內容製作團隊來說,短期內最實際的變化可能是ComfyUI工作流程的匯入通道。這群人手上早就累積了一堆參數調好的節點圖,能原封不動搬進來,就代表不用整個重新學一遍。切換工具最大的摩擦力,很少來自學不會新東西,多半來自捨不得丟掉已經跑順的那一套。
參考來源:MiniMax官方發布內容、愛范兒、CocoLoop編輯整理;H3單次生成時長上限與案例片長,以官方公開的展示內容為準。