DeepSeek V4 Flash API

284B合計/13B活動的な変数およびネイティブ1Mのコンテキストが付いている軽量のMoEモデルは、低レイテンシー、費用効果が大きい高通貨の使用のために調整しました。

DeepSeekテキスト生成1M コンテキストリリース 2026年4月24日Germany独自エンドポイント

DeepSeek V4 Flash について

284B合計/13B活動的な変数およびネイティブ1Mのコンテキストが付いている軽量のMoEモデルは、低レイテンシー、費用効果が大きい高通貨の使用のために調整しました。

別名 DeepSeek Flash, DeepSeek-V4-Flash

reasoningfunction calling

DeepSeek V4 Flash の仕様

モデルID
deepseek-v4-flash
プロバイダー
DeepSeek
カテゴリ
テキスト生成
リリース
2026年4月24日
コンテキスト長
1M トークン
最大出力
393,216 トークン
入力
テキスト
出力
テキスト
構造化出力
JSON Schema
リージョン
Germany
エンドポイント
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-flash:generateContent
代替モデルID
deepseek/deepseek-v4-flash

DeepSeek V4 Flash API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
$0.14
ソリューション
1M生成トークンあたり
$0.28
Web Search (Linkup)
per call when invoked
$0.013
料金ページ全体で比較

DeepSeek V4 Flash API の呼び出し方

DeepSeek V4 Flash は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID deepseek-v4-flash を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
DeepSeek V4 Flash API の完全リファレンス

DeepSeek V4 Flash API のパラメーター

EmpirioLabs 上の DeepSeek V4 Flash API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
temperaturenumber0.70 から 2サンプリング温度。0 = 決定論的、2 = 最大ランダム性。
top_pnumber0.90 から 1原子核サンプリング確率質量。低い方が = より集中しています。
max_tokensnumber40961 から 393216最大出力トークン。
stopstring--最大4つの文字列で、モデルはこれ以上のトークン生成を停止します。
enable_thinkingbooleantrue-答える前に、step-by-step理由をつけておきましょう。
thinking_budgetnumber327681 から 393216推論プロセスのために最大トークンが予約されています。393216まで。
reasoning_effortenummediumnone, low, medium, high, max推論の努力レベル。誰も思考を妨げるものではありません。低、中、高、最大は選択したモデルに合わせて限定された思考予算を設定します。OpenAIスタイルのreasoning_effortフィールドとして送られ、モデルサービス用にenable_thinkingとthinking_budgetに翻訳されました。
response_formatenum--出力をJSONに制約します。有効なJSONオブジェクトにはJSONモードを使い、提供したスキーマに一致する出力を強制的に行ってください。
web_search_linkupbooleanfalse-Linkupによるオプションのウェブ検索機能。有効化すると、最新のウェブソースが最新のユーザーメッセージをクエリとして取得し、モデルに追加のコンテキストとして提供されます。モデルの通常のトークンコストに加えて、呼び出しごとに$0.013が加算されます。デフォルトで無効化されています。
disable_formattingbooleanfalse-有効化されると、Linkupウェブ検索を使用したアシスタント応答に「ソース」フッターを付け加えません。モデル出力が装飾を期待しない別のシステムに送られる場合に有用です。

DeepSeek V4 Flash のバリアント

バリアントは独自のモデル ID を持つ DeepSeek V4 Flash の別バージョンです。バリアントによって提供リージョン、料金、対応パラメーターが異なる場合がありますが、それ以外は同じように動作します。

DeepSeek V4 Flash :variant1

モデルID
deepseek-v4-flash:variant1
リージョン
Singapore
コンテキスト長
1M トークン
構造化出力
JSON Schema
タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
$0.20
ソリューション
1M生成トークンあたり
$0.40
ウェブ検索
有効な要求が有効な場合ごとの
$0.02
:variant1 をプレイグラウンドで試す

DeepSeek V4 Flash :variant2最大2%お得

モデルID
deepseek-v4-flash:variant2
リージョン
China
コンテキスト長
1M トークン
構造化出力
JSON Schema
タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
$0.14$0.138
ソリューション
1M生成トークンあたり
$0.28$0.275
キャッシュの読み込み
1M キャッシュされた入力トークンあたり
$0.028
ウェブ検索
有効な要求が有効な場合ごとの
$0.01
:variant2 をプレイグラウンドで試す

DeepSeek V4 Flash API: よくある質問

DeepSeek V4 Flash API の料金はいくらですか?

EmpirioLabs では DeepSeek V4 Flash は従量課金です: パスワード $0.14 1M プロンプトトークンあたり; ソリューション $0.28 1M生成トークンあたり; Web Search (Linkup) $0.013 per call when invoked。このページのライブ料金表は常に API の請求額と一致します。

DeepSeek V4 Flash のコンテキストウィンドウはどれくらいですか?

DeepSeek V4 Flash は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 393,216 出力トークン)。

DeepSeek V4 Flash API は OpenAI 互換ですか?

はい。DeepSeek V4 Flash は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_urlhttps://api.empiriolabs.ai/v1 に向けてモデル ID を deepseek-v4-flash に設定するだけで動作します。

DeepSeek V4 Flash にはどんなバリアントがありますか?

DeepSeek V4 Flash は 3 個のモデル ID で利用できます: デフォルトの deepseek-v4-flash に加えて deepseek-v4-flash:variant1 (Singapore), deepseek-v4-flash:variant2 (China)。バリアントは提供リージョン、料金、対応パラメーターが異なる場合があり、それぞれの料金表はこのページにあります。

統合する前にブラウザで DeepSeek V4 Flash を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで DeepSeek V4 Flash をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

DeepSeek V4 Flash の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。