出来事の日付:2026年4月24日。 DeepSeekはV4モデルファミリーのプレビュー版を公開し、大規模なProモデルと、より小規模なFlashモデルを組み合わせ、モデルのウェイトも一般公開した。同社はまた、アプリケーション・プログラミング・インターフェースを更新し、公式サービス全体で100万トークンのコンテキストウィンドウを標準にすると述べた。
DeepSeekはV4-Proについて、総パラメーター数1兆6,000億、推論時のアクティブパラメーター数490億のMixture-of-Experts(専門家混合)モデルだと説明した。V4-Flashは総パラメーター数2,840億で、130億をアクティブ化する。同社はProをより高性能な選択肢、Flashをより高速で低コストな選択肢と位置付けた。発表によると、両モデルは思考モードと非思考モードをサポートしている。
両モデルはトークン単位の圧縮とDeepSeek Sparse Attention(DSA)を採用しており、開発元によれば、長いコンテキストを扱うワークロードにおける計算量とメモリー需要を削減するよう設計されている。DeepSeekは100万トークンの処理能力を特殊なプランではなく、チャット製品とAPIサービスを含む標準機能として提示した。提供された発表では、効率や性能に関する主張について独立した検証は示されなかった。
DeepSeekはまた、V4-Proがエージェント型コーディングのベンチマークでオープンモデル中トップ級の成績を収め、数学、科学、技術、工学、コーディングの評価でも高い性能を示したと主張した。同社は、自社比較において、このモデルの幅広い知識はGemini 3.1 Proにのみ及ばなかったと述べた。また、V4-FlashはProの推論能力に迫り、より単純なエージェントタスクでは同等だったとしている。これらはベンダーが報告したベンチマーク上の主張であり、独立したモデルランキングと解釈すべきではない。
開発者は、既存のDeepSeek APIのベースアドレスを維持し、モデル識別子を`deepseek-v4-pro`または`deepseek-v4-flash`に変更することで両モデルを利用できる。発表によると、このサービスはOpenAI Chat CompletionsとAnthropic APIの双方と互換性のあるインターフェースをサポートする。DeepSeekはClaude Code、OpenClaw、OpenCodeとの連携も挙げ、自社チームもエージェント型コーディング作業にV4を使用していると述べた。
今回の移行では、従来のエンドポイントの利用者に期限が設けられている。DeepSeekは、`deepseek-chat`と`deepseek-reasoner`を2026年7月24日15時59分(UTC)以降に廃止すると述べた。発表時点で、これらの識別子はそれぞれ非思考構成と思考構成のV4-Flashへすでにルーティングされていた。したがって既存アプリケーションには、明示的なV4モデル名を選択し、古い識別子が廃止される前にプロンプト、応答処理、使用量管理の調整が必要かどうかを評価するための3カ月の移行期間が与えられた。
このプレビューは、V4を単一の配布経路に限定せず、オープンウェイトとホスティング型アクセスを組み合わせている。導入を検討する利用者にとって中心的な論点は、独立して再現されたテストで両モデルがどのような性能を示すのか、継続的なワークロードで100万トークンモードにどれほどの費用がかかるのか、そしてプレビュー版の開発が進む中でもアプリケーションの挙動が安定しているかどうかである。



