Qwen3-Max推出混合推理模式,可自選是否思考

Qwen3系列中最具技術含量的設計之一是混合推理模式——同一個模型內建了thinking和non-thinking兩種工作狀態。

如何運作

  • Thinking模式:模型會先產生一段內部推理過程(類似Chain-of-Thought),然後基於推理結果給出回答。適合數學、邏輯、程式碼分析等需要深度思考的任務。
  • Non-thinking模式:跳過推理步驟,直接回應。適合日常對話、簡單問答。

開發者可以透過API參數控制使用哪種模式,也可以設為自動——讓模型自己判斷當前任務需不需要深度思考。

為什麼要做成一個模型

過去的做法通常是分開部署兩個模型——一個負責快速回應,一個負責深度推理。這意味著兩份部署成本、兩套維運。

混合模式的好處是一套部署搞定兩種需求。對於中小企業和預算有限的團隊來說,這個成本差異很實際。

技術上如何實現

Qwen3採用的方法是在訓練階段同時優化兩種目標:

  1. 在需要推理的資料上訓練thinking能力
  2. 在直接對話的資料上訓練快速回應能力

模型學會了根據輸入的特徵自動判斷「這個問題需不需要想一想」。

與其他家的對比

  • DeepSeek V3.1:也是雙模式,think/non-think
  • Claude Opus 4.6:自適應思考(四檔可調)
  • GPT-5.4 Thinking:獨立的thinking版本

大家殊途同歸,都意識到了「一個模型覆蓋兩種使用場景」是用戶真正需要的。

Qwen3-Max作為系列的旗艦版,在thinking模式下的數學和程式碼成績可以與DeepSeek R1正面競爭。non-thinking模式下的回應速度則快得多。這種靈活性是純推理模型做不到的。

參考來源:CocoLoop、阿里雲官方發布