DeepSeekは10月6日(現地時間)、同社が提供するAPIモデルIDと各モデルファミリの運用状況に関する詳細を明確にしたとbenchlm.aiが報じた。主力モデル「deepseek-flash」がDeepSeek V4.1 Flashを提供し、新規統合の推奨モデルとなっている。一方、「deepseek-v4-pro」はDeepSeek V4 Pro 0813を提供し続けるものの、DeepSeek自身はV4.1 Flashの優位性を強調している。

DeepSeekは現在、二つの主要なAPIモデルIDを公開している。「deepseek-flash」はDeepSeek V4.1 Flashを提供し、「deepseek-v4-pro」はDeepSeek V4 Pro 0813を提供している。両モデルIDは1Mトークンのコンテキストウィンドウに対応し、思考モード、非思考モード、およびより複雑なプロンプトのための推論設定をサポートする。

DeepSeek V4.1 Flashは、新しいCausal Encoder-Decoderアーキテクチャを採用した552BのMoE(Mixture-of-Experts)モデルである。このモデルは入力に8B、出力に16Bのアクティブパラメータを使用し、ネイティブ画像入力に対応する。ウェイトはMITライセンスに基づき公開されている。DeepSeekの発表によると、V4.1 Flashはエージェント的なコーディング、サイバー、ツール利用の各側面でV4 Proを上回り、価格もV4 Proより低く設定されている。V4.1 Flashの公開スコアは現時点では「未発表」の状態である。

旧モデルのV4 Flashは2026年9月10日に廃止され、そのレガシーIDdeepseek-v4-flashは現在V4.1 Flashにルーティングされる。DeepSeekは当初、2026年9月14日より「deepseek-v4-pro」からのリクエストもV4.1 Flashにルーティングすると発表していた。しかし、この方針は後に変更され、2026年9月17日の情報更新では、V4 Proサービスは料金変更なく継続されることが示されている。

DeepSeek V4 Proは公開スコアとして66/100を記録しているが、新規のルーティングルールをV4 Proに基づいて構築しないよう推奨されている。DeepSeekはV4.1 Flashがパフォーマンス、コスト、速度、総ランタイムの全てにおいて優位であるとの見方を示している。過去のモデル群であるDeepSeek R1、V3.2、V3.1、Coder、およびMathの各行は、再現性や自己ホスティングのために利用可能だが、現在のファーストパーティAPIの選択肢からは外れている。また、「deepseek-chat」およびdeepseek-reasonerというエイリアスは、2026年7月24日をもって廃止期限を迎えている。


参考: benchlm.ai — 2026年10月6日 09:00 (JST)

この記事をシェア
X はてブ LinkedIn