DeepSeekは正式にDeepSeek-V4.1-Flashをリリースしました。新しいアーキテクチャシリーズの中で最小モデルと公式に定義されており、マルチモーダル視覚的理解をネイティブにサポートし、コア目標は高い能力上限、より高速な推論、高いスループット、そしてより大きなモデルへのスケーリングです。Flashはもはや単なる「安価なバージョン」ではなく、次世代アーキテクチャの最初の場となりつつあります。
新しいアーキテクチャはまず小型モデルで実装されます
公式ベンチマークでは、V4.1 FlashはGPQA Diamond 90.9、Codeforces 3471、Terminal-Bench 2.1 90.6、DeepSWE v1.1 74.2を達成しました。ビジョン関連のBabyVision(ツール付き)は89.6点、Chartography(ツール付き)は78.9点を獲得しました。
これらの結果はDeepSeekの公式テストから得られており、独立した第三者検証と直接同一視することはできません。しかし方向性は明確です。DeepSeekは複数の専用エントリーポイントを分割し続けるのではなく、推論、コード、エージェント、ビジョンの機能を単一の高スループットモデルにまとめようとしています。
フラッシュはプロの任務を引き継ぎ始めました
DeepSeek V4.1 FlashはAPIをリリースし、モデル名はdeepseek-flashに変更されました。前世代のV4 FlashおよびV4 Flash Vision Expは廃止されました。旧モデル名は当面互換性があり、ルーティングはV4.1 Flashに統一されています。
さらに重要なのは、Proラインです。DeepSeekは、広範なテストの結果、V4.1フラッシュが性能、コスト、速度、総時間のすべてでV4 Proを上回ると発表しました。9月14日0時から、V4.1 Proのリリース前に、deepseek-v4-proリクエストはV4.1 Flashが処理し、Flash価格で料金が設定されます。
推論コストは引き続き低下しています
API仕様はAI推論効率の優先度も反映しています。V4.1 Flashは1Mコンテキスト、最大384K出力をサポートし、APIの同時実行制限は2500です。比較のために、現在のV4 Proは並行制限が500です。
オフピーク時には、キャッシュされた100万トークンあたりの入力価格は$0.003、キャッシュミスは$0.15、出力は$0.6、ピーク時には価格は倍増します。機能はProに近づきつつあり、価格はFlashティアのままであり、これがこのアップグレードの最も直接的な商用シグナルです。
V4.1 FlashはDeepSeekの新しいアーキテクチャのパイオニア版に近いもので、まず小型モデルでネイティブビジョン、高スループット、推論効率を検証し、その後より大きなモデルへとスケールアップします。次の鍵は、V4.1 Proがこのアーキテクチャの能力の上限をどれだけ引き伸ばすかです。