DeepSeek放出V4.1 Flash内测,9月10日到期

深度求索开放了 DeepSeek V4.1 Flash 的中间版本内测。官方给出的描述是采用新的模型结构,支持原生多模态,能力更强、速度更快、成本更低。

接入方式基本没有门槛:base_url 保持不变,模型名改成 deepseek-v4.1-flash-expires-on-0910 即可调用。计费与 deepseek-v4-flash 一致,每个账号限 20 并发。名字里的 0910 就是有效期,9 月 10 日之后这个模型 ID 失效。

原生多模态是这次改动的落点

此前用 Flash 系列处理图文混合输入,需要额外的视觉扩展包。这一版把这个能力做进了模型本体。

差别不只是少装一个包。扩展包的做法通常是先把图像过一遍单独的编码器再拼进文本序列,中间那道转换既吃延迟也吃精度;原生多模态意味着图像和文本在同一套结构里训练和推理。对 Flash 这条主打低延迟的产品线来说,这是一个方向性的调整——它要的不是更强的视觉理解上限,是不为多模态多付延迟。

按定位看,V4.1 Flash 落在现有的 V4 Flash 和 V4 Pro 之间:结构更新、带原生多模态,同时保住 Flash 系列一贯的低延迟特征。

到期日写进模型名的做法

这套命名不是第一次出现,但用在一个”中间版本”上,信息量比通告本身多。

模型 ID 带失效日期,意味着接进去的调用方必须在两天内做完评测并且知道要拔掉。这排除了任何生产环境的接入,剩下的用途基本只有一个:在真实流量下收集这套新结构的表现数据。48 小时的窗口、20 并发的账号上限,把它框成了一次压力测试而不是一次发布。

对国内开发者来说,实际能做的判断有限。参数规模、上下文长度变化和评测数据官方均未披露,V4.1 正式版的时间表、这套新结构会不会同步用到 Pro 档也没有说法。“更快更省”目前只有厂商一方口径,外部无法核实。能自己验证的只有价格没变这一条:同样的钱,跑两天。

值得对照的是这条产品线过去的节奏。V4-Flash 从预览到正式版 API 开放、V4-Pro 促销价写进永久价目、以及给 API 加高峰双倍价,这几步都在几个月内完成。DeepSeek 在版本迭代上一向不给长预告,这次连正式版的时间表也没有。

参考来源:DeepSeek 开放平台公告、IT之家、CocoLoop、澎湃新闻;模型 ID、计费口径与并发限制以官方内测说明为准,参数规模与评测数据官方未披露。