
284B合計/13B活動的な変数およびネイティブ1Mのコンテキストが付いている軽量のMoEモデルは、低レイテンシー、費用効果が大きい高通貨の使用のために調整しました。
284B合計/13B活動的な変数およびネイティブ1Mのコンテキストが付いている軽量のMoEモデルは、低レイテンシー、費用効果が大きい高通貨の使用のために調整しました。
別名 DeepSeek Flash, DeepSeek-V4-Flash
deepseek-v4-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-flash:generateContentdeepseek/deepseek-v4-flashEmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
DeepSeek V4 Flash は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID deepseek-v4-flash を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上の DeepSeek V4 Flash API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 から 2 | サンプリング温度。0 = 決定論的、2 = 最大ランダム性。 |
| top_p | number | 0.9 | 0 から 1 | 原子核サンプリング確率質量。低い方が = より集中しています。 |
| max_tokens | number | 4096 | 1 から 393216 | 最大出力トークン。 |
| stop | string | - | - | 最大4つの文字列で、モデルはこれ以上のトークン生成を停止します。 |
| enable_thinking | boolean | true | - | 答える前に、step-by-step理由をつけておきましょう。 |
| thinking_budget | number | 32768 | 1 から 393216 | 推論プロセスのために最大トークンが予約されています。393216まで。 |
| reasoning_effort | enum | medium | none, low, medium, high, max | 推論の努力レベル。誰も思考を妨げるものではありません。低、中、高、最大は選択したモデルに合わせて限定された思考予算を設定します。OpenAIスタイルのreasoning_effortフィールドとして送られ、モデルサービス用にenable_thinkingとthinking_budgetに翻訳されました。 |
| response_format | enum | - | - | 出力をJSONに制約します。有効なJSONオブジェクトにはJSONモードを使い、提供したスキーマに一致する出力を強制的に行ってください。 |
| web_search_linkup | boolean | false | - | Linkupによるオプションのウェブ検索機能。有効化すると、最新のウェブソースが最新のユーザーメッセージをクエリとして取得し、モデルに追加のコンテキストとして提供されます。モデルの通常のトークンコストに加えて、呼び出しごとに$0.013が加算されます。デフォルトで無効化されています。 |
| disable_formatting | boolean | false | - | 有効化されると、Linkupウェブ検索を使用したアシスタント応答に「ソース」フッターを付け加えません。モデル出力が装飾を期待しない別のシステムに送られる場合に有用です。 |
バリアントは独自のモデル ID を持つ DeepSeek V4 Flash の別バージョンです。バリアントによって提供リージョン、料金、対応パラメーターが異なる場合がありますが、それ以外は同じように動作します。
deepseek-v4-flash:variant1deepseek-v4-flash:variant2EmpirioLabs では DeepSeek V4 Flash は従量課金です: パスワード $0.14 1M プロンプトトークンあたり; ソリューション $0.28 1M生成トークンあたり; Web Search (Linkup) $0.013 per call when invoked。このページのライブ料金表は常に API の請求額と一致します。
DeepSeek V4 Flash は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 393,216 出力トークン)。
はい。DeepSeek V4 Flash は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_url を https://api.empiriolabs.ai/v1 に向けてモデル ID を deepseek-v4-flash に設定するだけで動作します。
DeepSeek V4 Flash は 3 個のモデル ID で利用できます: デフォルトの deepseek-v4-flash に加えて deepseek-v4-flash:variant1 (Singapore), deepseek-v4-flash:variant2 (China)。バリアントは提供リージョン、料金、対応パラメーターが異なる場合があり、それぞれの料金表はこのページにあります。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで DeepSeek V4 Flash をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。