MiniMax於9月27日在自家程式設計產品MiniMax Code上線了新的文字模型M3.1-Flash-Preview,官方定位是日常開發工作,從修小bug到做完整功能都能處理。同一天,MiniMax為所有使用者重置了Token Plan額度,另外發放額度重置卡;9月28日至10月7日期間,MiniMax Code的簽到點數加倍,新舊使用者都能參加,點數可用於各個模型。
目前這款模型只能透過兩個入口使用:Token Plan訂閱,以及MiniMax Code。按量計費的公開API尚未開放。
文件裡能確認的幾項
MiniMax開放平台的串接文件已經列出了這款模型的條目,能確認的規格有以下幾項:
- 上下文長度達100萬token,主要面向長文件、整個程式碼庫和多步驟的代理工作階段;
- 輸出速度標稱每秒100個token以上;
- 輸入支援文字、圖片和影片;
- 透過「effort」參數調整思考深度,分為low、medium、high、xhigh、max五檔,未指定時預設為max。
還有一項限制寫得很清楚:這款模型的思考功能無法關閉。呼叫時若試圖關掉推理,介面會直接回傳400錯誤,文件建議想降低延遲就把effort往下調。串接方式上,MiniMax同時提供Anthropic風格與OpenAI風格兩種端點,並將前者標為建議選項。
沒有公布的部分
這次上線相當低調。有科技媒體注意到,MiniMax沒有發出正式公告,也沒有模型卡、評測報告和價格。第三方排行榜BenchLM截至9月27日收錄的基準測試結果是0項。
那家媒體還提到,Hugging Face上出現了一個名為MiniMax-M3.1-preview-private的受限儲存庫,容量約250GB,外部無法下載。這是否就是Flash預覽版的權重、之後會不會像M3一樣開源,MiniMax目前沒有回應。五檔effort各自消耗多少運算資源、延遲差多少,文件裡同樣沒有給出數字。
和M3相比,發布節奏換了一種打法
6月1日發布的M3走的是另一種路線:開源權重、100萬上下文、原生多模態一起放出,搭配自研的稀疏注意力架構MSA和一整套程式設計跑分,SWE-Bench Pro報出59.0%,Terminal-Bench 2.1報出66.0%。當時MiniMax把「用得起的百萬上下文」當成主要賣點,數字給得很足。
M3.1-Flash-Preview走的是先推出產品、後補資料的路線:先讓付費使用者在MiniMax Code裡用起來,同時用額度重置和簽到活動把人拉回來。名字裡的Flash和Preview也說明了它的定位,一個是強調速度的輕量檔,一個是還沒定型。
這種節奏在中國國內的程式設計模型裡最近很常見。小米MiMo-V2.6分出Pro和Flash兩檔,Flash走效率路線;DeepSeek v4.1 Flash靠海外程式設計工具OpenCode贈送的額度拓展使用者;智譜AI也有GLM-5.3-Flash。程式設計工具的使用者對價格和回應速度最敏感,輕量檔先上、跑分後補,能更快拿到真實使用回饋。
對中國國內的開發者來說,眼下要試這款模型,得先有Token Plan訂閱或直接用MiniMax Code。effort預設是最高檔,如果只是修改小bug,手動調低一兩檔,回應會快一些,也更省額度。至於它比M3快多少、寫程式碼會不會掉分,只能等MiniMax放出評測,或第三方把基準測試跑出來再看。
參考來源:MiniMax官方社群帳號、MiniMax開放平台串接文件、AlphaSignal、CocoLoop、BenchLM;上下文長度、effort檔位與串接限制以MiniMax文件為準核實,M3跑分為廠商自行公布之數據。