深度求索(DeepSeek)開放了 DeepSeek V4.1 Flash 的中間版本測試。官方說法是採用新的模型架構、支援原生多模態,效能更強、速度更快、成本更低。
接入門檻幾乎是零:base_url 保持不變,只要把模型名稱改成 deepseek-v4.1-flash-expires-on-0910 就能呼叫。計費方式與 deepseek-v4-flash 一致,每個帳號同時並發上限為 20。名稱裡的「0910」就是有效期限,9 月 10 日之後這個模型 ID 就會失效。
原生多模態是這次改動的重點
先前用 Flash 系列處理圖文混合輸入,需要額外掛載視覺擴充套件。這一版把這項能力直接做進了模型本體。
差異不只是少裝一個套件而已。擴充套件的做法通常是先讓圖片經過獨立的編碼器,再拼接進文字序列,中間這道轉換既耗延遲也耗精確度;原生多模態代表圖片與文字是在同一套架構裡一起訓練、一起推論。對主打低延遲的 Flash 這條產品線來說,這是方向上的調整——它要的不是拉高視覺理解的能力上限,而是不要為了多模態多付延遲。
就定位而言,V4.1 Flash 落在現有的 V4 Flash 與 V4 Pro 之間:架構更新、具備原生多模態,同時保留 Flash 系列一貫的低延遲特性。
把到期日寫進模型名稱的做法
這種命名方式並非第一次出現,但用在一個「中間版本」上,透露的資訊比公告本身還多。
模型 ID 帶著失效日期,意味著接進來的開發者必須在兩天內完成評測,並且清楚知道屆時要拔掉。這幾乎排除了任何正式環境的接入,剩下的用途基本只有一個:在真實流量下蒐集這套新架構的表現數據。48 小時的視窗、每帳號 20 並發的上限,把它框定成一次壓力測試,而不是一次正式發布。
對中國的開發者來說,實際能做的判斷有限。參數規模、上下文長度的變化與評測數據官方都未公開,V4.1 正式版的時程、這套新架構會不會同步用到 Pro 等級也都沒有說法。「更快更省」目前只有廠商單方面的說法,外界無從查證。唯一能自行驗證的只有價格沒變這一點:同樣的錢,可以跑兩天。
值得對照這條產品線過去的節奏。V4-Flash 從預覽版走到正式版 API 開放、V4-Pro 的促銷價寫進永久價目表,以及替 API 加上尖峰時段雙倍收費,這幾步都在幾個月內完成。DeepSeek 在版本迭代上向來不太提前預告,這次連正式版的時程都沒有交代。
參考來源:DeepSeek 開放平台公告、IT之家、CocoLoop、澎湃新聞;模型 ID、計費依據與並發限制以官方測試說明為準,參數規模與評測數據官方未公開。