Google 將 Gemma 4 改為 Apache 2.0 協議開源,推出四款模型

4 月 2 日,Google DeepMind 發布了 Gemma 4。

這不是第一個 Gemma,但有兩點跟之前不一樣:一是切換到了 Apache 2.0 協議,二是 31B 這個版本在 Arena AI 開源榜上排到了 第三名

四個模型,怎麼選?

型號 類型 激活參數 上下文 特殊能力
E2B 密集型(端側優化) 2B 128K 音頻輸入
E4B 密集型(端側優化) 4B 128K 音頻輸入
26B A4B MoE ~4B 256K
31B 密集型(旗艦) 31B 256K

E2B 和 E4B 是給手機和邊緣設備用的,原生支援音頻輸入(語音辨識),多模態涵蓋文字+圖片+音頻。26B 的 MoE 設計和 DeepSeek 同理:總參數 26B,但推理時只激活約 4B,性價比高。

31B 是旗艦,在 Arena AI 文字榜上開源模型裡排第三,26B MoE 排第六。兩個大版本的表現都超過參數量少 20 倍的對手。

Apache 2.0 這件事的意義

之前的 Gemma 系列用的是自訂協議,有使用限制,商業場景下需要單獨跟 Google 談。切到 Apache 2.0 之後:

  • 隨便拿去商用,不用打申請
  • 可以改程式碼、二次散佈
  • 不需要附加任何條款

這跟 Qwen 3 的 Apache 2.0 開源策略是同一個方向。開源大模型的協議戰,現在基本上就是 Apache 2.0 為標準答案,誰還用限制性協議誰就吃虧。

端側能力有多實用?

E2B 和 E4B 的設計目標是手機和樹莓派。按照 Google 的說法,E4B 比之前版本 快 4 倍,省 60% 電。E2B 則有 3 倍更快的效能和更低延遲

考慮到現在主流旗艦手機的儲存和算力,E4B 應該可以流暢跑起來。Google 明確說了,Gemma 4 會作為今年晚些時候 Gemini Nano 4 在 Android 裝置上的基礎模型。換句話說,這不只是給開發者玩的,最終會落到普通用戶的手機裡。

跟 Meta Llama 4 比怎麼樣?

同期 Meta 也在推 Llama 4。兩家都在捲開源,都用了 MoE 或高效端側架構,都支援多模態,都用 Apache 2.0 協議。

Gemma 4 的差異化在端側:E 系列的音頻輸入支援和超低功耗設計,是 Llama 4 目前沒有重點發力的方向。如果你是做行動端或 IoT 場景的開發者,Gemma 4 的 E 系列值得認真考慮。

140 多種語言支援對非英語場景也很有意義,中文表現具體怎麼樣,等社群跑完測試再說。

參考來源:CocoLoop、Gemma 4: Byte for byte, the most capable open models(Google DeepMind Blog);Google Releases Gemma 4 in Four Model Sizes Under Apache 2.0 License(gHacks Tech News);Announcing Gemma 4 in the AICore Developer Preview(Android Developers Blog)