DeepSeek Pro、384K出力に対応

DeepSeek V4 Proは、プレビュー段階の話題から、より具体的なAPIサービスへ移った。8月13日、DeepSeekの価格ページでは deepseek-v4-pro のモデル版が DeepSeek-V4-Pro-0813 と表示されている。

表に並ぶ条件は明確だ。1M tokenのコンテキスト、最大384K tokenの出力、JSON Output、Tool Calls、Responses API、Anthropic APIに対応し、Proの同時実行上限は500。通常のチャットより、長いコードベースや文書束を扱う用途を意識した設定だ。

長い仕事ほど請求も伸びる

“We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.”

公式のこの注意書きは重要だ。384K出力は移行計画、監査報告、複数ファイルの修正案などには便利だが、生成量が増えれば出力課金も大きくなる。

ProはFlashの3倍価格

中国語の公式価格表では、V4 Proは100万tokensあたりキャッシュ命中入力0.025元、未命中入力3元、出力6元。V4 Flashは0.02元、1元、2元だ。未命中入力と出力ではProがFlashの3倍になる。

同時実行上限もProが500、Flashが2500と大きく違う。7月31日の更新ログでは、Flash 0731がTerminal Bench 2.1で82.7、Cybergymで76.7などのAgent系スコアを示していた。Proという名前だけで日常処理を全部移す判断は早い。

大きいモデルほど使い分けが要る

Hugging FaceとOpenRouterの説明では、V4 Proは総パラメータ1.6T、活性化49BのMoEモデルで、1M tokenコンテキストを持つ。高性能枠である一方、短い要約や単純な抽出には過剰になりやすい。

当面見るべき点は、DeepSeekがV4 Pro-0813単独の技術報告を出すか、第三者ベンチマークがPreviewやFlash 0731と分けて測るか、そして値上げ後も長文脈のコスト優位を保てるかだ。

参考情報:DeepSeek APIモデル・価格ドキュメント、DeepSeek API更新ログ、潮新聞、Hugging Face DeepSeek-V4-Proモデルカード、CocoLoop、OpenRouter;DeepSeek-V4-Pro-0813の版名、1Mコンテキスト、384K最大出力、人民元・米ドルの料金口径、同時実行上限、V4 Flashとの価格差、1.6T総パラメータと49B活性化パラメータを確認。