DeepSeek V4.1 FlashはEmpirioLabsで利用可能です。 これはDeepSeekの新しいアーキテクチャファミリーの軽量フラッグシップであり、入力用8Bのアクティブパラメータと出力用16Bの552Bパラメータmixture-of-expertsモデル、ネイティブ画像理解、100万トークンコンテキストウィンドウ、最大384K出力トークンを備えています。DeepSeekはDeepSeek V4 Proに先行してベンチマーク結果を発表しています。
モデルが行うこと
V4.1 Flashは同じリクエスト内でテキストと画像を読み取るため、スクリーンショット、図、写真をプロンプトと一緒に送信できます。ハイブリッド思考はデフォルトでオンで、モデルは回答する前に推論し、低遅延の返信のために思考をオフにしたり、思考予算で制限したりできます。関数呼び出しやJSONモードは標準のチャット完了画面で動作し、オプションのLinkupウェブ検索を有効にすると最近のウェブコンテキストが追加されます。
DeepSeek V4.1 Flashの呼び方
OpenAI互換のチャット完了エンドポイントを使い、設定してください モデル から deepseek-v4-1-flash.画像部品は標準を使用しています image_url コンテンツブロック:
curl https://api.empiriolabs.ai/v1/chat/completions \ -h 'Authorization: Bearer $EMPIRIOLABS_API_KEY' \ -H 'Content-Type: application/json' \ -d '{ "model": "deepseek-v4-1-flash", "enable_thinking": true, "thinking_budget": 32768, "messages": [ { "role": "user", "content": [ {"type": "text", "text": "このチャートは何を示しているのか?","この傾向を2文でまとめてください。"}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}} ] }'
同じモデルIDは、モデルページに記載されているResponses、Messages、Gemini互換エンドポイントにも適用されます。
作戦メモ
- JSONモード(a
response_format型json_objectメッセージのどこかにJSONという単語が必要になります。このモデルでは厳密なJSONスキーマ応答形式は利用できません。 - 推論トークンは出力トークンとして請求されます。集合
enable thinking を使うから偽り短く、レイテンシに配慮した返信、またはそれ以下の返信が欲しいですthinking_budget理屈を縛るために。
料金について
トークン使用は1つの公開入力レートと1つの公開出力レートで請求され、キャッシュ入力レートは別々にありません。リンクアップウェブ検索は、実行された場合にのみ通話ごとに少額の手数料が加算されます。ライブ モデルページ および プライシングページ 現在の金利についてです。
建設を始めろ
DeepSeek v4.1フラッシュを試してみてください プレイグラウンド, 読みます APIドキュメントまたは他のモデルと比較するか、 モデルカタログお問い合わせ.
ディスクロージャー:この記事は、EmpirioLabs AIによるAIの支援とレビューで書かれました.



