DeepSeek V4 Flash एपीआई

284B कुल/13B सक्रिय मापदंडों और मूल 1M संदर्भ के साथ हल्का MoE मॉडल, कम-विलंबता, लागत प्रभावी उच्च-समवर्ती उपयोग के लिए ट्यून किया गया।

DeepSeekपाठ निर्माण1M कॉन्टेक्स्टरिलीज 24 अप्रैल 2026Germanyस्वामित्व वाला एंडपॉइंट

DeepSeek V4 Flash के बारे में

284B कुल/13B सक्रिय मापदंडों और मूल 1M संदर्भ के साथ हल्का MoE मॉडल, कम-विलंबता, लागत प्रभावी उच्च-समवर्ती उपयोग के लिए ट्यून किया गया।

इस नाम से भी जाना जाता है DeepSeek Flash

reasoningfunction calling

DeepSeek V4 Flash की विशेषताएं

मॉडल ID
deepseek-v4-flash
निर्माता
DeepSeek
श्रेणी
पाठ निर्माण
रिलीज
24 अप्रैल 2026
कॉन्टेक्स्ट विंडो
1M टोकन
अधिकतम आउटपुट
3,93,216 टोकन
इनपुट
टेक्स्ट
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON Schema
रीजन
Germany
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-flash:generateContent
वैकल्पिक मॉडल ID
deepseek/deepseek-v4-flash

DeepSeek V4 Flash API की कीमतें

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$0.14
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$0.28
वेब खोज (लिंकअप)
प्रति कॉल जब लागू किया जाता है
$0.013
पूरे कीमत पेज पर तुलना करें

DeepSeek V4 Flash API को कैसे कॉल करें

DeepSeek V4 Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id deepseek-v4-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
DeepSeek V4 Flash API का पूरा संदर्भ

DeepSeek V4 Flash API के पैरामीटर

EmpirioLabs पर DeepSeek V4 Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber0.70 से 2नमूना तापमान। 0 = नियतात्मक, 2 = अधिकतम यादृच्छिकता।
top_pnumber0.90 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान। निचला = अधिक केंद्रित।
max_tokensnumber40961 से 393216अधिकतम आउटपुट टोकन।
stopstring--4 स्ट्रिंग्स तक जहां मॉडल आगे टोकन उत्पन्न करना बंद कर देगा।
enable_thinkingbooleantrue-उत्तर देने से पहले step-by-step तर्क सक्षम करें।
reasoning_effortenummediumnone, low, medium, high, maxतर्क प्रयास स्तर। कोई भी सोच को अक्षम नहीं करता है। निम्न, मध्यम, उच्च और अधिकतम सेट चयनित मॉडल के आकार के बाउंड थिंकिंग बजट। OpenAI-शैली reasoning_effort फ़ील्ड के...
thinking_budgetnumber327681 से 393216रीजनिंग प्रक्रिया के लिए आरक्षित अधिकतम टोकन। 393216 तक।
response_formatenum--आउटपुट को JSON पर सीमित करें। किसी भी मान्य JSON ऑब्जेक्ट के लिए JSON मोड का उपयोग करें, या आपके द्वारा प्रदान की गई स्कीमा से मेल खाने वाले आउटपुट को बाध्य करने के...
web_search_linkupbooleanfalse-लिंकअप द्वारा संचालित वैकल्पिक वेब खोज। सक्षम होने पर, हाल के वेब स्रोतों को आपके नवीनतम उपयोगकर्ता संदेश को क्वेरी के रूप में उपयोग करके पुनर्प्राप्त किया जाता है और मॉडल को अतिरिक्त संदर्भ के रूप में प्रदान किया जाता है। मॉडल की सामान्य टोकन लागत के शीर्ष पर लागू होने पर प्रति कॉल $0.013 जोड़ता है। डिफ़ॉल्ट रूप से अक्षम।
disable_formattingbooleanfalse-सक्षम होने पर, गेटवे "स्रोत" पाद लेख को सहायक प्रतिक्रियाओं में नहीं जोड़ेगा जो लिंकअप वेब खोज का उपयोग करते हैं। उपयोगी जब मॉडल आउटपुट को किसी अन्य सिस्टम में पाइप...

DeepSeek V4 Flash के वेरिएंट

वेरिएंट DeepSeek V4 Flash के वैकल्पिक संस्करण हैं जिनकी अपनी model id होती है। वेरिएंट के अनुसार serving region, कीमतें या समर्थित पैरामीटर अलग हो सकते हैं; बाकी सब वैसा ही काम करता है।

DeepSeek V4 Flash :variant1

मॉडल ID
deepseek-v4-flash:variant1
रीजन
Singapore
कॉन्टेक्स्ट विंडो
1M टोकन
संरचित आउटपुट
JSON Schema
प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$0.20
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$0.40
वेब खोज
सक्षम होने पर प्रति अनुरोध
$0.02
Playground में :variant1 आज़माएं

DeepSeek V4 Flash :variant22% तक बचाएं

मॉडल ID
deepseek-v4-flash:variant2
रीजन
China
कॉन्टेक्स्ट विंडो
1M टोकन
संरचित आउटपुट
JSON Schema
प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$0.14$0.138
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$0.28$0.275
अंतर्निहित कैश पढ़ा गया
प्रति 1M कैश्ड इनपुट टोकन
$0.028
वेब खोज
सक्षम होने पर प्रति अनुरोध
$0.01
Playground में :variant2 आज़माएं

DeepSeek V4 Flash :variant3

मॉडल ID
deepseek-v4-flash:variant3
रीजन
United States
कॉन्टेक्स्ट विंडो
1M टोकन
संरचित आउटपुट
JSON Schema
प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$0.20
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$0.40
वेब खोज (लिंकअप)
प्रति कॉल जब लागू किया जाता है
$0.013
Playground में :variant3 आज़माएं

DeepSeek V4 Flash API: आम सवाल

DeepSeek V4 Flash API की कीमत कितनी है?

EmpirioLabs पर DeepSeek V4 Flash का बिल उपयोग के अनुसार बनता है: इनपुट $0.14 प्रति 1M प्रॉम्प्ट टोकन; उत्पादन $0.28 प्रति 1M जेनरेट किए गए टोकन; वेब खोज (लिंकअप) $0.013 प्रति कॉल जब लागू किया जाता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

DeepSeek V4 Flash की context window कितनी है?

DeepSeek V4 Flash 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 3,93,216 आउटपुट टोकन के साथ।

क्या DeepSeek V4 Flash API OpenAI-संगत है?

हां। DeepSeek V4 Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id deepseek-v4-flash रखकर काम करते हैं।

DeepSeek V4 Flash के कौन से वेरिएंट उपलब्ध हैं?

DeepSeek V4 Flash 4 model ids के रूप में उपलब्ध है: डिफ़ॉल्ट deepseek-v4-flash और deepseek-v4-flash:variant1 (Singapore), deepseek-v4-flash:variant2 (China), deepseek-v4-flash:variant3 (United States)। वेरिएंट serving region, कीमतों या समर्थित पैरामीटरों में अलग हो सकते हैं; हर एक की दर तालिका इसी पेज पर है।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में DeepSeek V4 Flash आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में DeepSeek V4 Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

DeepSeek V4 Flash की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।