GPT Image 2.5 Sunburst and Flare are now live on CometAPI →
technology/CometAPIリサーチ

DeepSeek V4.1 Flash とは何か?アーキテクチャ、機能、価格

DeepSeek V4.1 Flash 解説:Causal-Encoder-Decoder を備えた 552B MoE、KV キャッシュ削減、ベンチマーク、API 料金、ネイティブビジョン、および V4 Flash/V4 Pro の比較。

CometAPI
Mia MarenAIモデルとAPIの調査チーム
更新日 Sep 10, 2026 6 分読み
DeepSeek V4.1 Flash とは何か?アーキテクチャ、機能、価格
このパターンを使う

最初のAPI呼び出しを行う。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

DeepSeek V4.1 Flash は、短命なベータ版の物語を本番リリースに置き換え、非対称計算、ネイティブなマルチモーダリティ、より強力なエージェント系ベンチマーク、そして大幅に低い API 価格を中核に据えています。

TL;DR

DeepSeek V4.1 Flash は、有効期限付きのベータエンドポイントではなく、正式な API かつオープンウェイトモデルになりました。DeepSeek によると、これは新しい Causal-Encoder-Decoder アーキテクチャを採用した 552B パラメータの Mixture-of-Experts(MoE)モデルです。入力処理中にアクティブ化されるのは 8B パラメータ、出力生成中は 16B パラメータです。この非対称設計は、自己回帰的な生成段階の強さを損なうことなく、長いプロンプトに対する計算量を抑えることを意図しています。

本番 API のモデル名は deepseek-flash です。1M トークンのコンテキストウィンドウ、最大 384K の出力トークン、思考モードと非思考モード、JSON 出力、ツール呼び出し、Responses API、Anthropic 互換 API、ネイティブなビジョン入力をサポートします。DeepSeek の公式ベンチマーク表では、コーディング、エージェント、サイバーセキュリティ、マルチモーダルタスクで、V4 Flash 0731 と V4 Pro 0813 の双方に対する実質的な向上が示されています。

価格変更も同様に重要です。ピーク時における V4.1 Flash の料金は、キャッシュヒット入力トークンが 100 万あたり $0.006、キャッシュミス入力トークンが 100 万あたり $0.30、出力トークンが 100 万あたり $1.20 です。オフピーク料金はこれらの半額です。

Key Takeaways

  • DeepSeek V4.1 Flash はオープンウェイトのリリース済みモデルであり、一時的な deepseek-v4.1-flash-expires-on-0910 識別子は本番参照として正しくありません。
  • 552B の MoE 設計で、入力時に 8B、出力時に 16B をアクティブ化し、V4 Flash の 284B 合計/13B アクティブ構成とは異なる効率プロファイルを実現します。
  • ネイティブなマルチモーダリティがメインモデルの一部となり、別個の Vision Exp ブランチは不要です。
  • 公式比較では、選定されたエージェントおよびコーディング系ベンチマークの大半で V4.1 Flash が V4 Pro 0813 を上回っていますが、知識系やターミナル系のあらゆるベンチマークで常に先行するわけではありません。
  • グローバル KV キャッシュはトークンあたり 890 バイトまで低下し、V4 Flash 比で約 3.9 倍小さく、以前のフットプリントの約 4 分の 1 です。
  • ピーク時の API 価格は、キャッシュヒット入力が 100 万トークンあたり $0.006、キャッシュミス入力が $0.30、出力が $1.20。オフピークはこれらの 50% です。

What Is DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash は、推論、コーディング、エージェント、マルチモーダル理解のための効率重視の基盤モデル(2026 年 9 月)です。公式発表では、入力処理に必要な計算とメモリを削減しつつ能力を向上させた 552B パラメータの MoE モデルと説明されています。

鍵となる変更はアーキテクチャです。以前の V4 Flash は推論全体で同一のアクティブパラメータ枠を用いていました。V4.1 Flash は入力と出力のワークロードを分離し、プロンプトのエンコード時は 8B、回答生成時は 16B のパラメータをアクティブ化します。DeepSeek はこの設計を Causal-Encoder-Decoder と呼んでいます。

DateStatusModel ID
Sep 8限定ベータdeepseek-v4.1-flash-expires-on-0910
Sep 10本番リリースdeepseek-flash

DeepSeek V4.1 Flash Specification:

SpecificationDeepSeek V4.1 Flash
Release status正式な API リリースかつオープンウェイトモデル
ArchitectureCausal-Encoder-Decoder 構造の Mixture-of-Experts
Total parameters552B
Activated parameters入力で 8B、出力で 16B
Context window1M tokens
Maximum output384K tokens
Input modalitiesテキストと画像
Output modalityテキスト
Production API model namedeepseek-flash
Thinking modes思考モードと非思考モード
API featuresJSON 出力、ツール呼び出し、Responses API、Anthropic API、プレフィックス補完、FIM 補完
Open weightsHugging Face で公開

How Does the DeepSeek V4.1 Flash Work: Causal-Encoder-Decoder

従来のデコーダ専用言語モデルは、プロンプト処理とトークン生成に実質的に同一の大規模スタックを用います。DeepSeek V4.1 Flash は、それらの段階に異なるアクティブ容量を割り当てます。

入力段階では、モデルは 8B のアクティブフットプリントでプロンプトを処理します。この段階では、完全な回答がまだ生成されていないため、提供されたテキストまたは画像コンテキストを効率的に精査できます。出力段階では、16B のパラメータをアクティブ化し、因果的なトークン逐次生成を継続します。したがって、この設計はプロンプトのエンコードで計算資源を節約しつつ、推論と応答生成に十分なアクティブ容量を維持します。

DeepSeek は発表の中であらゆる実装詳細を公開していないため、最も安全な説明は機能面にとどまります。すなわち、アーキテクチャは非対称であり、入力と出力段階で異なるアクティブパラメータ予算を用い、その結果として推論時のメモリとコストを削減します。

KV Cache Reduction

メモリに関する結果は測定可能です。DeepSeek は V4.1 Flash において、グローバル KV キャッシュがトークンあたり 890 バイトであると報告しています。これは V4 Flash の 3,514 バイト、V3.2 の 48,068 バイト、V1 の 389,120 バイトと比較され、V4.1 の数値は V4 Flash より約 3.9 倍小さいことになります。

DeepSeek V4.1 Flash とは何か?アーキテクチャ、機能、価格

長コンテキストのエージェントにとって、これは単一のベンチマークを超えて重要です。より小さい KV キャッシュは、リクエスト処理中の高帯域幅メモリ(HBM)への負荷を低減し、より遅いストレージへ移す必要のある状態量も削減します。DeepSeek によれば、V4.1 Flash は、比較可能なキャッシュワークロードにおいて、前モデルに比べておよそ 4 分の 1 の HBM と 8 分の 1 の SSD 容量で済みます。

DeepSeek V4.1 Flash Features

Native Multimodal Input

V4.1 Flash はメインモデル API の一部として画像入力を受け付けます。これは、テキスト専用の V4 Flash と、実験的な V4 Flash Vision エンドポイントとの分割を置き換えるものです。開発者は、ドキュメント理解、チャート分析、スクリーンショット解釈、ビジュアルエージェントのワークフローを、同一の本番モデルファミリー上で構築できるようになりました。

Long-Context Reasoning

公式 API 仕様では、1M トークンのコンテキストウィンドウと最大 384K の出力トークンが維持されています。これにより、リポジトリ規模のコーディング、複数ドキュメントの分析、長時間のエージェントセッション、巨大なツール履歴を保持する必要があるワークフローに適しています。

Production API Features

思考/非思考モード、構造化 JSON 出力、ツール呼び出し、Responses API、Anthropic 互換インターフェース、チャットのプレフィックス補完、非思考モードでの FIM 補完をサポートします。これらの機能により、V4.1 Flash は多くの V4 Flash のエージェント/コーディング系ワークロードの直接的な本番代替となります。

Open Weights

DeepSeek は V4.1 Flash のウェイトとテクニカルレポートを公開しました。この公開により再現性が向上しますが、モデル自体は非常に大きいままです。DeepSeek の発表では、大規模導入を検討する組織に対し、おおよそ 2,000 基の GPU とストレージクラスターを計画するよう求めています。

DeepSeek V4.1 Flash Benchmark Performance

公式結果により、V4.1 にベンチマーク証拠がないという以前の見解は修正されました。DeepSeek は、知識、数学、コーディング、ターミナルエージェント、サイバーセキュリティ、オートメーション、マルチモーダルエージェントタスクにわたる広範な表を提供しています。

DeepSeek V4.1 Flash とは何か?アーキテクチャ、機能、価格

BenchmarkDeepSeek V4.1 FlashV4 Pro 0813V4 Flash 0731
GPQA Diamond90.992.489.9
Codeforces rating347133483289
MathArena Apex65.665.358.6
Terminal-Bench 2.190.687.982.7
DeepSWE v1.174.262.754.4
NL2Repo-Bench65.461.554.2
CyberGym88.183.376.7
Automation-Bench54.843.237.7

この選定された 8 つのベンチマークにおいて、V4.1 Flash は 7 テストで V4 Pro 0813 を上回り、8 テストすべてで V4 Flash 0731 を上回っています。最大の向上はソフトウェアエンジニアリングとエージェントで見られ、DeepSWE は V4 Pro 比で 11.5 ポイント、V4 Flash 比で 19.8 ポイント上昇し、Automation-Bench はそれぞれ 11.6 と 17.1 ポイント向上しています。

結果は慎重に解釈する必要があります。V4.1 Flash は GPQA Diamond では V4 Pro を下回り、完全な公式チャートでは、Terminal-Bench 3.0 において Claude Opus 5 と GPT-5.6 Sol が依然として先行しています。実用的な結論としては、V4.1 Flash が DeepSeek の効率と能力のバランスを大きく改善しているということです。この表は、すべてのタスクにおける普遍的な優位性を証明するものではありません。

DeepSeek V4.1 Flash API Pricing

DeepSeek はピークとオフピークの二段階課金を採用しています。ピーク時間は「月曜日〜金曜日の 01:00–04:00 および 06:00–10:00(UTC)」であり、それ以外(週末を含む)はオフピークです。現在の価格ドキュメントでは、オフピーク価格はピーク価格の半額としています。

Price per 1M tokensV4.1 Flash off-peakV4.1 Flash peakV4 Pro 0813 off-peakV4 Pro 0813 peak
Cache-hit input$0.003$0.006$0.022$0.044
Cache-miss input$0.15$0.30$0.66$1.32
Output$0.60$1.20$1.98$3.96

DeepSeek V4.1 Flash とは何か?アーキテクチャ、機能、価格

節約効果は大きいです。キャッシュミス入力トークン 1 億、出力トークン 1,000 万を使用するワークロードでは、V4.1 Flash の費用はオフピークで約 $21、ピーク時で約 $42 です。同一トークン構成での V4 Pro 0813 公開料金では、オフピーク約 $85.80、ピーク約 $171.60 となります。この例では、V4.1 Flash は約 75.5% 低コストです。

プロンプトキャッシュは、システムプロンプト、リポジトリ文脈、ドキュメントを繰り返し再利用するエージェントにとって優位性をさらに強めます。V4.1 のキャッシュヒット単価は、ピーク/オフピークいずれにおいてもキャッシュミス単価の 1/50 です。

DeepSeek V4.1 Flash vs V4 Flash vs V4 Pro

DimensionDeepSeek V4.1 FlashDeepSeek V4 FlashDeepSeek V4 Pro
Total parameters552B284B1.6T
Activated parameters8B input / 16B output13B49B
Architecture focus入出力の非対称効率軽量な V4 MoE最大の V4 容量
Native visionYes別の Vision Exp バリアントNo
Context window1M1M1M
Maximum output384K384K384K
API status on DeepSeek現行の本番モデルリタイア済み;レガシー名は V4.1 Flash にルーティング2026 年 9 月 14 日から V4.1 Flash にルーティング予定
Best fit汎用エージェント、コーディング、ビジョン、高スループット互換性維持のための移行用途のみ既存の Pro ワークロードの移行期間中の利用

V4.1 Flash は総パラメータ数では V4 Flash より大きいものの、入力段階でアクティブ化するのは 8B にとどまり、KV キャッシュも大幅に小さいため、提供コストを低く抑え得ます。V4 Pro と比較すると、アクティブパラメータは大幅に少ない一方で、上記の選定されたエージェントおよびコーディング系ベンチマークの多くで Pro を上回っています。

API Access and Migration

DeepSeek の本番モデル名は deepseek-flash です。既存アプリケーションは OpenAI 互換のベース URL https://api.deepseek.com または Anthropic 互換のベース URL https://api.deepseek.com/anthropic. を維持できます。

  1. モデル名を deepseek-flash に更新します。
  2. 既存の DeepSeek ベース URL と認証方式をそのまま使用します。
  3. 本番プロンプトで思考モード、ツール呼び出し、ビジョン入力、レイテンシ、トークン使用量を再検証します。
  4. レガシー別名を監視します:deepseek-v4-flashdeepseek-v4-flash-vision-exp は現在 V4.1 Flash にルーティングされ、deepseek-v4-pro は 9 月 14 日から V4.1 Flash にルーティングされる予定で、将来の V4.1 Pro リリースまで継続されます。

CometAPI ユーザー向けには、CometAPI における DeepSeek V4.1 API が既存の DeepSeek V4 Flash API と並行して稼働中です。本番トラフィックに切り替える前に、最終的なモデル名、価格、別名対応が DeepSeek 公式 API と一致しているかを CometAPI ダッシュボードで確認してください。サードパーティでは命名や課金が公式と異なる場合があります。

Who Should Use DeepSeek V4.1 Flash?

V4.1 Flash は、コーディングエージェント、リポジトリ分析、ターミナル自動化、マルチモーダルドキュメントのワークフロー、長コンテキストのアシスタント、高ボリュームのツール使用システムに適しています。ベンチマークの向上は、キャッシュメモリとトークン価格の低下から最も恩恵を受けるワークロードに集中しています。

すでに V4 Flash を使用しているチームは、直接の移行候補として扱うべきです。V4 Pro を使用しているチームは綿密なテストが必要ですが、DeepSeek 自身のベンチマークと価格データに基づけば、多くの Pro クラスのワークロードにおいて V4.1 Flash の方が経済的なデフォルトになります。

セルフホスティングは別の判断です。オープンウェイトであっても 552B のモデルが軽量になるわけではありません。大規模 GPU とストレージの導入コストを、ホスト型 API の利用と比較検討したうえでローカル推論にコミットすべきです。

Limitations and Open Questions

  • ベンチマーク結果は DeepSeek の公式評価セットアップに基づくものであり、異なるハーネスやツール環境でのパフォーマンスを測るには独立した再検証が必要です。
  • ネイティブなマルチモーダル対応は確認されていますが、アプリケーションチームはサポートされる画像形式、トークン計上、ビジョン挙動をライブ API で検証すべきです。
  • レガシーモデル別名は、既存名の背後にあるモデルを変更するため、アプリケーションコードを変えずとも出力が変化する可能性があります。
  • V4.1 Flash は以前の DeepSeek モデルに比べてインフラ要件を下げていますが、オープンウェイトのデプロイであっても依然として相当な計算資源とストレージを要します。
  • CometAPI の専用 V4.1 エンドポイントと最終価格は、本番利用前にライブコンソールで確認してください。

Final Verdict

DeepSeek V4.1 Flash は主要なアーキテクチャおよびプロダクトのアップデートです。552B の MoE モデルは、入力で 8B、出力で 16B をアクティブ化し、ネイティブなビジョン、1M トークンのコンテキストウィンドウ、圧縮された KV キャッシュを組み合わせています。これらの設計選択は、V4 Pro 0813 と比べて大幅に低い API 価格で、公式のコーディングおよびエージェント系ベンチマークにおける強化へと結びついています。

最も実用的な変化は統合です。V4.1 Flash はテキスト、ビジョン、推論、ツール利用、長コンテキスト運用を 1 つの本番モデル名に集約しました。多くの新規 DeepSeek 統合において、deepseek-flash が論理的な出発点となり、V4 Pro は難易度の高い作業に対する自動的な選択肢ではなく、移行時の比較対象になります。

FAQ

Is DeepSeek V4.1 Flash officially released?

Yes。モデル名 deepseek-flash で DeepSeek の API から利用可能であり、オープンウェイトと技術報告が公開されています。

Is the temporary V4.1 beta model ID still required?

No。deepseek-v4.1-flash-expires-on-0910 は短命のベータ識別子でした。本番アプリケーションは deepseek-flash を使用してください。

How many parameters does DeepSeek V4.1 Flash have?

モデルは合計 552B パラメータです。入力処理中は 8B、出力生成中は 16B のパラメータがアクティブ化されます。

Does DeepSeek V4.1 Flash support images?

Yes。ビジョン入力は本番モデルにネイティブ対応しており、別個の V4 Flash Vision Exp エンドポイントは不要です。

Is V4.1 Flash better than V4 Pro?

DeepSeek が公開したコーディング、エージェント、オートメーション、サイバーセキュリティの比較では大半で V4 Pro 0813 を上回りますが、GPQA Diamond では V4 Pro が先行しています。移行前に自チームのプロンプトで両者を評価してください。

How much does the API cost?

ピーク時の 100 万トークンあたりの料金は、キャッシュヒット入力が $0.006、キャッシュミス入力が $0.30、出力が $1.20 です。オフピークはこれらの半額です。

What happens to the old V4 model names?

レガシーの deepseek-v4-flashdeepseek-v4-flash-vision-exp は V4.1 Flash にルーティングされます。DeepSeek によれば、deepseek-v4-pro も 2026 年 9 月 14 日から V4.1 Flash にルーティングされ、V4.1 Pro がリリースされるまで継続されます。

Can I use DeepSeek V4.1 Flash through CometAPI?

Yes。CometAPI は現在、DeepSeek V4.1 API エンドポイントを提供しています。本番トラフィックを流す前に、CometAPI コンソールで正確なモデル名、価格、対応機能を確認してください。サードパーティは、DeepSeek の公式 API と異なる命名規則や課金体系を採用している場合があります。

学習を続ける

この記事を次の判断につなげる。

すべてのトピックを見る
公開日 Sep 10, 2026
最終更新 Sep 10, 2026
0 回視聴
明確性、出典の帰属、最新のAPI用語について確認済みです。

AI開発コストを20%削減する準備はできていますか?

数分で無料スタート。無料トライアルクレジット付き。クレジットカード不要。

もっと読む