DeepSeek V4 對決 Qwen 3.5:兩款中國開源模型爭奪同一市場

如果你最近在關注 AI 行業,應該會注意到一件有意思的事:兩款中國開源模型正在搶佔同一片市場,而且都在用極低的成本挑戰那些動輒要價幾十美元每百萬 token 的閉源巨頭。

DeepSeek V4 和 Qwen 3.5(部分渠道已標示為 Qwen 3.6-Plus),這兩款你搞清楚了嗎?

先看數字

DeepSeek V4:

  • 總參數量約 1 兆(實際激活約 320 億)
  • 上下文視窗:100 萬+ token
  • API 定價:約 0.14 美元/百萬輸入 token
  • 訓練成本:個位數百萬美元量級

Qwen 3.5/3.6-Plus:

  • 總參數量約 3970 億(實際激活約 170 億)
  • 上下文視窗:100 萬 token
  • 許可證:Apache 2.0(完全開放商用)
  • 支援語言:201 種

對比 GPT-5 的 API 定價(約 5 美元/百萬輸入 token),DeepSeek V4 大約是它的三十五分之一的價格

這兩款到底誰更能打

老實說,各有絕活,不是同一回事。

DeepSeek V4 的優勢在哪:

  • 超大上下文處理能力,丟給它一個幾百萬字的程式碼庫或長文件,它不會崩潰
  • 原生多模態,文字、圖片、影片、音訊一把抓,不需要外接適配器
  • 對大規模程式碼工程的理解力目前是開源中最強的

Qwen 3.5 的底牌:

  • Apache 2.0 許可,企業可以隨意商用,這點 DeepSeek 做不到
  • 201 種語言支援,要做多語言應用、特別是東南亞或小語種市場,Qwen 是首選
  • 內建 thinking/non-thinking 兩種推理模式,做 Agent 開發更靈活
  • MathVision 基準 88.6 分,數學推理能力不弱

一句話總結:DeepSeek V4 適合處理大文件、跑大程式碼庫的場景;Qwen 3.5 適合多語言、Agent 開發、合規要求高的場景。

為什麼這件事值得關注

兩年前,中國 AI 模型在全球市場的佔有率大概只是個零頭。現在,DeepSeek 和 Qwen 加起來已經拿下了大約 15% 的全球 AI 市場份額,而且這個曲線在繼續往上。

更關鍵的是,它們打破了一個預設假設——你要有好模型就得有大預算。

GPT-5 據估計訓練花了超過 1 億美元,而 DeepSeek V4 的訓練成本可能在 幾百萬美元 量級。最終訓練出來的東西,在很多任務上差距已經縮小到了統計噪音的範圍內。

對開發者意味著什麼

如果你現在在選 AI API 來搭建產品:

  • 預算敏感、高調用量:DeepSeek V4 的價格優勢太明顯,很難繞過
  • 需要商用友好的許可證:Qwen 的 Apache 2.0 是開源模型中最乾淨的
  • 做多語言 SaaS:Qwen 的 201 語言支援真的很好用
  • 大程式碼庫分析:DeepSeek V4 的百萬 token 上下文加上原生程式碼能力更適合

閉源模型在複雜多步推理和頂尖程式設計任務上還有優勢,但這個差距正在快速縮小。

還沒結束

DeepSeek V4 的完整版(兆級參數)實際上還沒正式對外發布。3 月 9 日出來的是約 2000 億參數的 V4 Lite 版。完整版本預計就在這幾週內。

Qwen 這邊,3.6-Plus 在 3 月底上線 OpenRouter,4 月 2 日才正式對外公告,剛出來就跑出了在真實終端任務上超越 Claude Opus 4.5 的成績。

這兩款同時發力,同時搶市場,同時把價格打到地板上——這才是讓整個行業緊張的真正原因。

參考來源:DeepSeek V4 and Qwen 3.5: Open-Source AI Is Rewriting the Rules in 2026(Particula.tech);CocoLoop、DeepSeek V4 Release Imminent — China's Next-Gen AI Model Race Accelerates(Jangwook.net)