DeepSeek V4.1 Flash 実践ガイド

2026-09-10、DeepSeek は新アーキテクチャ世代の最小モデル DeepSeek-V4.1-Flash を正式リリースしました。 料金は V4 Pro から大幅に下がり、性能・コスト・速度・総時間のいずれでも V4 Pro を上回ると公式が説明しています。 このページでは、公式料金ページとChange Logだけで裏取りした料金・スペック・ベンチマークに加え、 VS Code GitHub Copilot Chat での導入手順と、V4 Pro が 2026-09-14 からどうなるかを整理します。 料金比較は 料金比較ページ、コスト試算は トークン計算機、リリース経緯は リリース年表も参照してください。

最終更新:  |  一次情報: 公式料金ページChange Log(2026-09-10)  |  取得日: 2026-09-11

3行でわかる要点

  • 現行の主力は V4.1 Flash。モデルID(APIリクエストで指定する文字列)は deepseek-flash(VS Code 側の表示・選択肢は拡張機能の更新により異なる場合があります)。コンテキスト1M・最大出力384K・ネイティブ画像入力対応。
  • 料金は V4 Pro から大幅ダウン。入力(cache miss)オフピーク $0.15 / ピーク $0.30、出力 オフピーク $0.60 / ピーク $1.20(USD・1Mトークンあたり)。
  • 2026-09-14 13:00 JST 以降、deepseek-v4-pro 宛のリクエストは V4.1 Flash にルーティングされ、V4.1 Flash の価格で課金されます。V4.1 Pro のリリース時期は公式に未発表です。

公式料金(2026-09-11時点)

単位は USD / 1Mトークン。オフピークはピークの半額です。

✅ api-docs.deepseek.com の Models & Pricing を Firecrawl で直接確認(2026-09-11)。
DeepSeek V4.1 Flash と V4 Pro の料金比較(USD/1M tokens、ピーク/オフピーク)
項目オフピークピーク
入力(cache hit)$0.003$0.006
入力(cache miss)$0.15$0.30
出力$0.60$1.20

📘 cache hit / cache miss とは: 同じプロンプトの先頭部分が DeepSeek 側のキャッシュに残っていれば cache hit(入力 $0.003 / 1Mトークン=cache miss の 1/50)、残っていない通常の入力が cache miss($0.15)。長いシステムプロンプトを毎回同じ順序で送るほどヒットしやすくなります。

V4 Pro との単価比較(参考)

V4 Pro と V4.1 Flash の単価比較
項目V4 Pro(〜2026-09-13)V4.1 Flash
入力 cache miss(オフピーク)$0.66$0.15約77% 減
入力 cache hit(オフピーク)$0.022$0.003約86% 減
出力(オフピーク)$1.98$0.60約70% 減

ピーク時間帯: 01:00-04:00 UTC と 06:00-10:00 UTC の 月〜金のみ日本時間 10:00-13:00 / 15:00-19:00/北京時間 09:00-12:00 / 14:00-18:00)。土日は終日オフピーク。ピーク/オフピーク制は 2026-08-16 16:00 UTC 発効です。一次情報: api-docs.deepseek.com(2026-09-11 取得)。

コスト試算は トークン計算機で、V4.1 Flash のオフピーク/ピーク両方が選べます。他社モデルとの比較は 料金比較(DeepSeek)を参照してください。

V4 Pro はどうなる?(retire スケジュール)

公式ドキュメントの注記に基づく事実のみを記載します。

⚠️ 2026-09-14 13:00 JST 以降の挙動

  • 公式は「V4.1 Flash が性能・コスト・速度・総時間で V4 Pro を全面的に上回るため、V4 Pro を順次 retire する予定」と明記しています。
  • 2026-09-14 12:00 北京時間(= 04:00 UTC = 13:00 JST)以降、将来 V4.1 Pro がリリースされるまでの間、deepseek-v4-pro 宛のリクエストは全て V4.1 Flash にルーティングされ、V4.1 Flash の価格で課金されます。
  • つまり API キーやコードを書き換えなくてもリクエストは通りますが、実際に応答するモデルと請求単価は V4.1 Flash になります。
  • V4.1 Pro のリリース時期は公式に発表されていません。日付の約束はなく、「将来リリースされたとき」とだけ記載されています。
  • 返ってくるモデル名や応答の癖が変わる可能性があるため、本番運用ではレスポンスの内容を一度確認することをおすすめします。

旧モデル名の扱い

旧モデル名の扱い
モデル名状態実挙動
deepseek-flash現行DeepSeek-V4.1-Flash。新規実装はこれを使う
deepseek-v4-pro退役予定2026-09-14 13:00 JST 以降、V4.1 Flash へルーティング(Flash 価格で課金)
deepseek-v4-flash退役済み互換のため一時的に受理。V4.1 Flash が処理し Flash 価格で課金
deepseek-v4-flash-vision-exp退役済み同上(旧 Vision 実験版も V4.1 Flash へ統合)
deepseek-chat / deepseek-reasoner終了旧エイリアスは 2026-07-24 に終了

出典: Models & Pricing の注記(1)(2)Change Log 2026-09-10。V4 Pro の経緯と移行時の注意点はV4 Pro の経緯ページにまとめています。

スペック(公式機能表)

DeepSeek V4.1 Flash の仕様
項目V4.1 Flash(deepseek-flash
モデルバージョンDeepSeek-V4.1-Flash
コンテキスト長1M トークン
最大出力384K トークン(公式表記 MAXIMUM: 384K)
thinking modenon-thinking / thinking の両対応(thinking が既定
Vision(画像入力)対応 ✓(旧 V4 Pro は非対応)
Tool Calls / JSON Output対応 ✓
Responses API / Anthropic API対応 ✓(OpenAI互換・Anthropic互換の両方が利用可)
Chat Prefix Completion(Beta)対応 ✓
FIM Completion(Beta)non-thinking モードのみ
同時実行数(Concurrency Limit)2500(旧 V4 Pro は 500)
BASE URLhttps://api.deepseek.com(OpenAI形式)/https://api.deepseek.com/anthropic(Anthropic形式)

出典: api-docs.deepseek.com Models & Pricing(2026-09-11 取得)。同時実行数の詳細は公式の Rate Limit & Isolation を参照してください。

公式ベンチマーク(2026-09-10 発表)

DeepSeek が Change Log で公表した数値です。当サイトで再計測したものではありません。

DeepSeek V4.1 Flash の公式ベンチマーク
ベンチマークスコア
GPQA Diamond90.9
HLE36.8(39.1)※純テキスト部分集合のみで計測
Codeforces(Rating)3471
MathArena Apex65.6
Terminal-Bench 2.190.6
Terminal-Bench 3.030.0
Terminal-Bench 4.031.2
DeepSWE v1.174.2
NL2Repo-Bench65.4
CyberGym88.1
SEC-Bench Pro62.8
ProgramBench20.3
ExploitGym15.3
HLE(ツールあり)63.9
Automation-Bench54.8
Agents' Last Exam31.8
Chartography(ツールあり)78.9
BabyVision(ツールあり)89.6
ZeroBench-main(ツールあり)49.0

出典: Change Log「DeepSeek-V4.1-Flash Release」(2026-09-10)。ベンチマークの数値は提供元の自己申告であり、当サイトは検証していません。

導入手順(VS Code GitHub Copilot Chat・3ステップ)

運営者(okamoちゃんねる)が V4 系で実際に行った手順です。拡張機能の名称・モデルピッカーの表示は更新される場合があるため、公式の手順も併せて確認してください。

STEP 1

APIキーを取得

platform.deepseek.com でアカウント登録。PayPal またはクレジットカード(VISA/Mastercard)でチャージし、sk- から始まるAPIキーを発行します。完全プリペイド方式で、最低チャージは $2 です。

STEP 2

拡張機能をインストール

VS Code Marketplace で DeepSeek V4 for Copilot Chat(発行元: Vizards)をインストールします。

STEP 3

設定して利用開始

コマンドパレット(Cmd/Ctrl+Shift+P)→ DeepSeek: Set API Key でキーを登録。Copilot Chat のモデルピッカーで DeepSeek V4 系を選ぶと会話を開始できます。

💡 モデル名をコードから直接指定する場合は deepseek-flash を使います。既存コードが deepseek-v4-pro を指している場合も、2026-09-14 13:00 JST 以降は V4.1 Flash が応答します(上記の注意点を参照)。

運営者の導入記録(2026-07-04・V4 Pro 時点のもの): okamoちゃんねるの導入手順メモ

よくある質問

Q. DeepSeek V4.1 Flash の料金はいくらですか?

A. 1Mトークンあたり、入力(cache miss)がオフピーク $0.15・ピーク $0.30、入力(cache hit)がオフピーク $0.003・ピーク $0.006、出力がオフピーク $0.60・ピーク $1.20 です。ピークは平日の 01:00-04:00 UTC と 06:00-10:00 UTC(日本時間 10:00-13:00 / 15:00-19:00)で、土日は終日オフピーク。オフピークはピークの半額です。

Q. 9月14日以降に deepseek-v4-pro を使うとどうなりますか?

A. 2026-09-14 13:00 JST(北京時間 12:00)以降、将来 V4.1 Pro がリリースされるまで、deepseek-v4-pro 宛のリクエストは全て V4.1 Flash にルーティングされ、V4.1 Flash の価格で課金されます。コードを書き換えなくても動きますが、実際に動くモデルと請求単価は V4.1 Flash になります。

Q. DeepSeek V4.1 Pro はいつリリースされますか?

A. 2026-09-11 時点で公式にリリース時期は発表されていません。公式ドキュメントは「将来 V4.1 Pro がリリースされるまで(until V4.1 Pro is released in the future)」とだけ記載しており、日付の約束はありません。当サイトでも公式発表が出た時点で更新します。

Q. 画像を読めますか?

A. はい。V4.1 Flash は新アーキテクチャ世代でネイティブのマルチモーダル視覚理解に対応し、公式の機能表でも Vision が「✓」です(旧 V4 Pro は非対応)。画像を含むモデル横断の比較は マルチモーダル対応LLM一覧を参照してください。

Q. deepseek-v4-flash のままでも動きますか?

A. 一時的な互換のために受理されますが、対応する旧モデルは退役済みで、リクエストは V4.1 Flash が処理し V4.1 Flash の価格で課金されます。新規実装では deepseek-flash を指定してください。

Q. コンテキスト長と最大出力は?

A. コンテキスト長 1M トークン、最大出力 384K トークンです。thinking mode は non-thinking と thinking の両方に対応し、thinking が既定です。

出典

⚠️ 免責事項

  • 本ページの料金・スペック・ベンチマークは DeepSeek 公式ページ(api-docs.deepseek.com)の 2026-09-11 取得内容に基づきます。料金・モデルの提供状況は予告なく変動することがあります。契約・本番利用前に必ず公式ページをご確認ください。
  • ベンチマーク値は提供元の公表値であり、当サイトが再計測・検証したものではありません。
  • 導入手順は運営者の環境(2026年7月時点の V4 Pro での記録)に基づきます。拡張機能の仕様変更により表示が異なる場合があります。
  • 本サイトは特定プロバイダーの推薦・代理ではありません。DeepSeek は DeepSeek の商標です。GitHub、GitHub Copilot は GitHub, Inc. の商標または登録商標です。