DeepSeek V4.1 Flash API

DeepSeekの新しいアーキテクチャの軽量フラッグシップで、ネイティブな画像理解、ハイブリッド思考、100万のコンテキスト、最大384Kの出力トークンを備えています。

DeepSeekテキスト生成1M コンテキストリリース 2026年9月10日Singapore独自エンドポイント新着

DeepSeek V4.1 Flash について

DeepSeekの新しいアーキテクチャの軽量フラッグシップで、ネイティブな画像理解、ハイブリッド思考、100万のコンテキスト、最大384Kの出力トークンを備えています。

テキストと画像入力、enable_thinkingとthinking_budgetのハイブリッド思考、関数呼び出し、JSONモード出力、オプションのLinkupウェブ検索をサポートしています。思考トークンは出力トークンとして請求されます。

別名 DeepSeek Flash

reasoningvisionfunction callingagentic coding

DeepSeek V4.1 Flash の仕様

モデルID
deepseek-v4-1-flash
開発元
DeepSeek
カテゴリ
テキスト生成
リリース
2026年9月10日
コンテキスト長
1M トークン
最大出力
393,216 トークン
入力
テキスト画像
出力
テキスト
構造化出力
JSON モード
リージョン
Singapore
エンドポイント
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-1-flash:generateContent
代替モデルID
deepseek-v4.1-flashdeepseek/deepseek-v4-1-flashdeepseek-ai/deepseek-v4-1-flash

DeepSeek V4.1 Flash API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
入力
1Mプロンプトトークンあたり
$0.30
ソリューション
生成された1Mトークンあたり
$1.20
ウェブ検索(リンクアップ)
呼び出し時の通話ごと
$0.013
料金ページ全体で比較

DeepSeek V4.1 Flash API の呼び出し方

DeepSeek V4.1 Flash は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID deepseek-v4-1-flash を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-1-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="deepseek-v4-1-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
DeepSeek V4.1 Flash API の完全リファレンス

DeepSeek V4.1 Flash API のパラメーター

EmpirioLabs 上の DeepSeek V4.1 Flash API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
temperaturenumber0.70 から 2サンプリング温度。0 = 決定論的、2 = 最大ランダム性。
top_pnumber0.90 から 1原子核サンプリング確率質量。低い方が = より集中しています。
max_tokensnumber40961 から 393216最大出力トークン。
stopstring--最大4つの文字列で、モデルはこれ以上のトークン生成を停止します。
enable_thinkingbooleantrue-答える前に、step-by-step理由をつけておきましょう。
reasoning_effortenummediumnone, low, medium, high, max推論の努力レベル。誰も思考を妨げるものではありません。低、中、高、最大は選択したモデルに合わせて限定された思考予算を設定します。OpenAIスタイルのreasoning_effortフィールドとして送られ、モデルサービス用にenable_thinkingとthinking_budgetに翻訳されました。
thinking_budgetnumber327681 から 393216推論プロセスのために最大トークンが予約されています。393216まで。
response_formatenum--出力を有効なJSONオブジェクト(JSONモード)として返します。プロンプトで使いたいフィールドを説明してください。
web_search_linkupbooleanfalse-Linkupによるオプションのウェブ検索機能。有効化すると、最新のウェブソースが最新のユーザーメッセージをクエリとして取得し、モデルに追加のコンテキストとして提供されます。モデルの通常のトークンコストに加えて、呼び出しごとに$0.013が加算されます。デフォルトで無効化されています。
disable_formattingbooleanfalse-有効化されると、Linkupウェブ検索を使用したアシスタント応答に「ソース」フッターを付け加えません。モデル出力が装飾を期待しない別のシステムに送られる場合に有用です。

知っておくと便利

思考機能はデフォルトで有効化されており、無効化も可能です。推論トークンは出力トークンとして請求されます。画像入力はテキストと共に受け入れられます。JSONモードもサポートされています。このモデルでは厳密なJSONスキーマの出力は利用できません。オプションのリンクアップウェブ検索は、呼び出しされた場合にのみ請求されます。

DeepSeek V4.1 Flash API: よくある質問

DeepSeek V4.1 Flash API の料金はいくらですか?

EmpirioLabs では DeepSeek V4.1 Flash は従量課金です: 入力 $0.30 1Mプロンプトトークンあたり; ソリューション $1.20 生成された1Mトークンあたり; ウェブ検索(リンクアップ) $0.013 呼び出し時の通話ごと。このページのライブ料金表は常に API の請求額と一致します。

DeepSeek V4.1 Flash のコンテキストウィンドウはどれくらいですか?

DeepSeek V4.1 Flash は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 393,216 出力トークン)。

DeepSeek V4.1 Flash API は OpenAI 互換ですか?

はい。DeepSeek V4.1 Flash は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_urlhttps://api.empiriolabs.ai/v1 に向けてモデル ID を deepseek-v4-1-flash に設定するだけで動作します。

統合する前にブラウザで DeepSeek V4.1 Flash を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで DeepSeek V4.1 Flash をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

DeepSeek V4.1 Flash の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。