阿里以Apache協議開源Qwen3

阿里今年把Qwen3全系列模型用Apache 2.0協議開源了,從0.6B到235B一共8個尺寸,全線開放。

為什麼Apache協議很重要?

Apache 2.0基本上是最寬鬆的開源協議之一,意味著企業可以免費商用,不用額外談授權。對比之下,Meta的Llama系列雖然也號稱「開源」,但實際上是「開放權重」,有各種使用限制。阿里這次的開放力度在國內大模型廠商裡算是最到位的。

技術特點

Qwen3最有意思的設計是混合推理模式——同一個模型內建了thinking mode和non-thinking mode:

  • Thinking mode:深度推理,適合數學、程式碼、邏輯分析
  • Non-thinking mode:快速回應,適合日常對話

一個模型搞定兩種場景,不用在「推理模型」和「對話模型」之間切換,對部署成本的優化很直接。

跑分

Qwen3-235B(MoE,激活22B參數)在多項benchmark上和DeepSeek R1、GPT-4o打得有來有回。成本端因為MoE架構,實際推理開銷只相當於一個22B的dense模型。

更小尺寸的版本也有驚喜——Qwen3-4B在不少任務上打平了上一代的Qwen2.5-72B。四十多倍的參數差距被抹平了,這個進步幅度有點誇張。

阿里的策略很明確:用最激進的開源搶生態。開發者用Qwen3練手、做產品、搞商業化都沒有授權障礙,生態跑起來之後再從雲端服務上賺錢。對標的就是Meta用Llama拉開源生態的那套打法。

參考來源:阿里雲官方發布、CocoLoop、Qwen GitHub倉庫