9月 10, 2026, DeepSeekがV4.1を発表 新しいアーキテクチャを導入し、API 価格をシャープにカットするマルチモーダル言語モデル。
新しいキャスカルエンコーダデコーダアーキテクチャ
会社はV4.1を呼び出します 新しい家族の中で最も小さいモデルをフラッシュします。 「Causal Encoder-Decoder」の設計は、552 億の分岐パラメータの混合-of-experts コアを使用しており、DeepSeek は入力時に 8 億のパラメーターのみが有効であり、出力には 16 億のパラメーターが使用されます。 以前の世代と比較して、このモデルは、HBMのわずか4分の1と、そのKVキャッシュのSSDストレージの8分の1を報告しました。
マルチモーダル、オープン重量、低価格
V4.1 Flashはイメージをネイティブに理解し、 deepseek-flash ワンミリオン・トークン・コンテキスト・ウィンドウで終点。 DeepSeekは、ハッギングフェイスのオープン級モデルとして重量を公表します。 発売時に価格が低下: ピーク時間の間に価格表は、その半分に設定されたオフピークレートで、100万トークン(キャッシュミス)あたり$ 0.030で入力を引用し、$ 12.20で出力します。
性能のクレームは、洞窟で来ます
DeepSeek は、V4.1 フラッシュをパフォーマンス、コスト、スピード、およびトータルランタイムで発信する V4-Pro の先に置いた「複数のパーティによってテスト」をポイントします。まだ独立して検証されていないベンダーの数字です。 2026年9月14日、DeepSeekはV4-ProのリクエストをV4.1-Proのバリアントが到着するまで自動的にルーティングする予定です。
ソース: DeepSeek – DeepSeek-V4.1-Flashの紹介 そして、 DeepSeek API Docs で発表お問い合わせ



















