MiniMax 9 月 27 日在自家编程产品 MiniMax Code 上线了新文本模型 M3.1-Flash-Preview,官方给的定位是日常开发,从修小 bug 到做完整功能都能接。同一天,MiniMax 给所有用户重置了 Token Plan 额度,另发额度重置卡;9 月 28 日到 10 月 7 日,MiniMax Code 签到积分翻倍,新老用户都能参加,积分可用于各个模型。
目前这款模型只能通过两个入口用到:Token Plan 订阅,以及 MiniMax Code。按量付费的公开 API 还没开放。
文档里能确认的几项
MiniMax 开放平台的接入文档已经给出了这款模型的条目,能确认的规格有这几项:
- 上下文 100 万 token,面向长文档、整个代码库和多步代理会话;
- 输出速度标称每秒 100 个 token 以上;
- 输入支持文本、图片和视频;
- 用
effort参数调思考深度,分 low、medium、high、xhigh、max 五档,不填默认是 max。
还有一条限制写得很明白:这款模型的思考无法关闭。调用时如果试图关掉推理,接口会直接返回 400 错误,文档建议想降延迟就把 effort 往下调。接入方式上,MiniMax 同时给了 Anthropic 风格和 OpenAI 风格两个端点,并把前者标为推荐。
没有公布的部分
这次上线相当低调。有技术媒体注意到,MiniMax 没有配发正式公告,也没有模型卡、评测报告和价格。第三方榜单 BenchLM 截至 9 月 27 日收录的基准结果是 0 项。
那家媒体还提到,Hugging Face 上出现了一个名为 MiniMax-M3.1-preview-private 的受限仓库,体积约 250GB,外人无法下载。这是否就是 Flash 预览版的权重、后续会不会像 M3 那样开源,MiniMax 目前没有回应。五档 effort 各自消耗多少算力、延迟差多少,文档里也没有数字。
和 M3 比,发布节奏换了一种
6 月 1 日发布的 M3 是另一种打法:开源权重、100 万上下文、原生多模态一起放出,配套的是自研稀疏注意力架构 MSA 和一整张编程跑分,SWE-Bench Pro 报了 59.0%,Terminal-Bench 2.1 报了 66.0%。那次 MiniMax 把”用得起的百万上下文”当作主卖点,数字给得很足。
M3.1-Flash-Preview 走的是先进产品、后补资料的路线:先让付费用户在 MiniMax Code 里用起来,同时用额度重置和签到活动把人拉回来。名字里的 Flash 和 Preview 也说明了它的位置,一个是面向速度的轻量档,一个是还没定型。
这种节奏在国内编程模型里最近很常见。小米 MiMo-V2.6 分出 Pro 和 Flash 两档,Flash 走效率路线;DeepSeek v4.1 Flash 靠海外编程工具 OpenCode 的赠送额度铺用户;智谱也有 GLM-5.3-Flash。编程工具的用户对价格和响应速度最敏感,轻量档先上、跑分后补,能更快拿到真实使用反馈。
对国内开发者来说,眼下要试这款模型,得先有 Token Plan 订阅或者直接用 MiniMax Code。effort 默认是最高档,如果只是改改小 bug,手动调低一两档,响应会快一些,也更省额度。至于它比 M3 快多少、写代码掉不掉分,只能等 MiniMax 放出评测,或者第三方把基准跑出来再看。
参考来源:MiniMax 官方社交账号、MiniMax 开放平台接入文档、AlphaSignal、CocoLoop、BenchLM;上下文长度、effort 档位与接入限制以 MiniMax 文档口径核验,M3 跑分为厂商自报。