DeepSeek V4、Huaweiチップで稼働へ

DeepSeekはまもなくV4をリリースするが、今回最も注目すべき点はモデルパラメータの大きさではなく、どのチップ上で動作するかである。

The Informationの報道によると、DeepSeek V4はHuaweiのAscend 950PRチップ上で動作する。これは中国国産チップアーキテクチャ専用に構築された初のフロンティアAIモデルとなる。

モデル自体の概要

V4のスペックは非常に強力である:

パラメータ数値
総パラメータ数約1兆(MoEアーキテクチャ)
推論時活性化パラメータ数約370億
コンテキストウィンドウ100万トークン
SWE-benchスコア81%

MoEアーキテクチャ採用の論理はV3と同じである:1兆のパラメータを保持し、推論ごとに370億のみを活性化する。実際の運用コストは370億の高密度モデルに近く、能力は1兆パラメータモデルの領域に達する可能性がある。トレーニング後のAPI価格は100万トークンあたり0.30ドルで、GPTシリーズより一桁安い。

マルチモーダル機能も統合されている:V4はテキスト、画像、動画生成をネイティブで処理する。

Huaweiチップが重要な理由

DeepSeekの以前のモデル(V3やR1を含む)は、NVIDIA A100/H100を使用してトレーニングされていた(少なくともCUDAエコシステムを使用していた)。V4は初めてHuaweiのCANNアーキテクチャに基づいてゼロから構築された。

Ascend 950PRのハードウェア仕様:

  • 演算性能:FP8 1 PFLOPS / FP4 2 PFLOPS
  • 相互接続帯域幅:2 TB/s
  • 製造プロセス:SMIC N+3プロセス(性能は5nm級に近い)
  • Huawei Atlas 350アクセラレータカードに搭載

DeepSeekはこのチップでV4を動作させるために、HuaweiおよびCambriconと協力して大量の低レベルコードを書き換え、NVIDIAのCUDAエコシステムを完全に回避することを目指している。

TrendForceの分析によれば、これが順調に進めば、DeepSeekの開発パイプラインは1〜2年以内にCUDAからの実質的な独立を達成できる可能性がある。

Alibaba、ByteDance、TencentがHuaweiチップを争奪

市場の反応は直接的である:Alibaba、ByteDance、TencentはHuaweiに対して合計数十万枚のAscendチップの注文を出した。需要が急増し、Huaweiのチップ価格はすでに約20%上昇している。

Huaweiは2026年に約60万枚のAscend 910Cを生産する計画で、2025年から倍増し、総Ascend生産能力は160万枚に達する。

別の視点から見ると:DeepSeek V4がHuaweiチップ上で良好に動作すれば、中国国内のAIベンダーは現実的な代替経路を持つことになる——NVIDIAへの完全な依存から脱却できる。これはV4自体よりも業界全体にとって大きな意味を持つ。

しかしHuaweiチップは本当に十分なのか?

正直なところ、これはまだ未知数である。

Ascend 950PRの理論上の演算性能数値は良好に見えるが、実際の分散トレーニングと推論の効率については、NVIDIA H100エコシステムと比較した大規模な検証データはまだない。V4-Liteは現在APIノードで内部テスト中であり、開発者は推論速度が30%向上し、コンテキスト呼び出しも顕著に改善されたと報告している——ただし、これは特別に最適化された環境での話である。

本当の試練は:V4正式版リリース後、性能が宣伝通りに安定するかどうかである。

成功すれば、これは中国AIハードウェア独立路線の真の証明となる。うまくいかなかったとしても、独立の方向性は正しいが、時期がまだ早すぎることを示すだけである。

V4正式版は4月中旬にリリースされる見込みである。結果を待とう。

出典:CocoLoop、DeepSeek's V4 model will run on Huawei chips, The Information reports(WHBL);Decoding DeepSeek V4: How Huawei's Ascend 950PR Is Powering China's Push to Break CUDA Dependence(TrendForce);DeepSeek V4 points to growing use of Huawei chips in AI models(TechWire Asia);DeepSeek V4 And Tencent's New Hunyuan Model To Launch In April(Dataconomy)