
लागत प्रभावी ओमनी मोडल मॉडल हैंडलिंग पाठ, छवि, ऑडियो और वीडियो, ऑडियो के 3 घंटे और 90+ भाषाओं में 1 घंटे वीडियो के साथ।
लागत प्रभावी ओमनी मोडल मॉडल हैंडलिंग पाठ, छवि, ऑडियो और वीडियो, ऑडियो के 3 घंटे और 90+ भाषाओं में 1 घंटे वीडियो के साथ।
इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.5 Omni Flash, Qwen3.5-Omni-Flash, qwen3-5-omni-flash
qwen3-5-omni-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/audio/speechPOST/v1beta/models/qwen3-5-omni-flash:generateContentqwen3.5-omni-flashEmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।
Qwen3.5 Omni Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-5-omni-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-5-omni-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-5-omni-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs पर Qwen3.5 Omni Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।
| पैरामीटर | प्रकार | डिफॉल्ट | रेंज / मान | विवरण |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 से 2 | नमूना तापमान। 0 = नियतात्मक, 2 = अधिकतम यादृच्छिकता। |
| top_p | number | 0.9 | 0 से 1 | नाभिक नमूनाकरण संभाव्यता द्रव्यमान। निचला = अधिक केंद्रित। |
| max_tokens | number | 4096 | 1 से 32768 | प्रतिक्रिया में अधिकतम टोकन। |
| output_mode | enum | text | text, text_audio | आउटपुट स्वरूप मोड। पाठ = केवल पाठ, ऑडियो = संश्लेषित भाषण शामिल करें। |
| voice | string | Tina | - | ऑडियो आउटपुट के लिए आवाज का नाम (जब output_mode = ऑडियो)। |
| tool_web_search | boolean | false | - | जरूरत पड़ने पर मॉडल को वेब खोज करने की अनुमति दें। |
| video_fps | number | 2 | 0.1 से 10 | विश्लेषण के लिए इनपुट वीडियो से फ्रेम्स-प्रति-सेकंड का नमूना लिया गया। |
| vl_high_resolution_images | boolean | true | - | इनपुट छवियों के लिए उच्च रिज़ॉल्यूशन का उपयोग करें। उच्च लागत पर बेहतर विवरण। |
| max_pixels | number | 2621440 | 1 से 99999999 | प्रति इनपुट छवि अधिकतम पिक्सेल। बड़ा = अधिक विवरण लेकिन धीमा/अधिक टोकन। |
| response_format | enum | - | - | आउटपुट को JSON पर सीमित करें। किसी भी मान्य JSON ऑब्जेक्ट के लिए JSON मोड का उपयोग करें, या आपके द्वारा प्रदान की गई स्कीमा से मेल खाने वाले आउटपुट को बाध्य करने के... |
ऑडियो बिलिंग - ऑडियो को text/image /वीडियो की तुलना में उच्च टोकन दर पर बिल दिया जाता है - जब ऑडियो आउटपुट सक्षम होता है, तो आउटपुट टेक्स्ट को चार्ज नहीं किया जाता है - केवल ऑडियो टोकन **वॉयस और भाषा* - 55 वॉयस टेम्ब्रे उपलब्ध - ऑडियो आउटपुट 29 भाषाओं, 7 डायलेक्ट्स का समर्थन करता है
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
EmpirioLabs पर Qwen3.5 Omni Flash का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।
Qwen3.5 Omni Flash 256K टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 32,768 आउटपुट टोकन के साथ।
हां। Qwen3.5 Omni Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-5-omni-flash रखकर काम करते हैं।
हां। EmpirioLabs playground ब्राउज़र में Qwen3.5 Omni Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।
EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।
हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।