Qwen3.8 ओमनी फ्लैश अलीबाबा का ओमनी-इनपुट फ्लैश मॉडल है: यह टेक्स्ट, इमेज, ऑडियो और वीडियो पढ़ता है, और यह टेक्स्ट में जवाब देता है। यह 1M टोकन संदर्भ के साथ शिप करता है, यह सोचकर कि डिफ़ॉल्ट रूप से चालू है, फ़ंक्शन कॉलिंग, सख्त JSON स्कीमा संरचित आउटपुट, और एक अंतर्निहित टूल, वेब खोज।
Qwen3.8 Omni Flash आज EmpirioLabs पर एक OpenAI-संगत API के माध्यम से लाइव है, जिसमें स्ट्रीमिंग और 128K आउटपुट टोकन तक हैं। इसे में आज़माएं खेल इसे किसी भी OpenAI-compatible क्लाइंट से कॉल करें। पूर्ण कल्पना और वर्तमान दरों पर रहते हैं Qwen3.8 ओमनी फ्लैश मॉडल पेज और एपीआई डॉक।.
एक ही लॉन्च में शिपिंग है Qwen3.8 लाइवट्रांसलेट फ्लैश रीयलटाइम: WebSocket पर बोले जाने वाले अनुवाद. लक्ष्य भाषा सेट करें, बोलें और मॉडल पाठ और ऑडियो के साथ उस भाषा में उत्तर देता है. इसे में खोलें खेल या कनेक्ट करें wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime. विवरण लाइव पर रीयलटाइम वॉयस एपीआई पृष्ठ।
मूल्य निर्धारण
Omni Flash बिलिंग का उपयोग एक फ्लैट इनपुट दर और हर प्रॉम्प्ट आकार पर एक फ्लैट आउटपुट दर के साथ किया जाता है। ऑडियो और वीडियो टोकन टेक्स्ट के समान इनपुट दर का उपयोग करते हैं; एक वीडियो के साउंडट्रैक को उसके वीडियो टोकन के साथ ऑडियो टोकन के रूप में गिना जाता है। वेब खोज एक छोटा प्रति-कॉल शुल्क जोड़ती है जो केवल तभी लागू होती है जब कोई कॉल वास्तव में चलती है। टोकन को आउटपुट टोकन के रूप में सोचना।
LiveTranslate बिल प्रत्येक को मॉडल रिपोर्ट के उपयोग से पूरा करता है, ऑडियो टोकन और टेक्स्ट टोकन के लिए अलग-अलग दरों के साथ। दोनों मॉडलों के लिए वर्तमान दरें हमेशा उनके पर रहती हैं मॉडल पेज और मूल्य निर्धारण पृष्ठ, जो आप जो चार्ज कर रहे हैं उसके साथ सिंक में रहते हैं।.
क्विकस्टार्ट
EmpirioLabs आधार URL पर किसी भी OpenAI SDK को इंगित करें और पास करें qwen3-8-omni-flash मॉडल के रूप में:
OpenAI आयात OpenAI क्लाइंट से = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model ="qwen3-8-omni-flash", messages=[ {"role": "user", "content": [ {"type": "text", "text": "क्या कहा जा रहा है, और स्क्रीन पर क्या है?"}, {"type": "input_audio", "input_audio": { "format": "mp3", "data": "https://example.com/clip.mp3", }}, ]}, ], extra_body={"enable_thinking": सच, "thinking_budget": 8192},) print(resp.choices[0].message.content)
वही मॉडल आईडी काम करती है TOKEN, मानवशास्त्रीय आकार का TOKEN, और Google-संगत /v1beta/models/qwen3-8-omni-flash:generateContent मार्ग। वैकल्पिक आईडी qwen3.8-omni-flash उसी मॉडल को हल करता है।
WebSocket पर LiveTranslate करें
LiveTranslate HTTP नहीं है। उसी एपीआई कुंजी के साथ रीयलटाइम सॉकेट से कनेक्ट करें जिसका उपयोग आप हर जगह करते हैं, फिर एक भेजें session.update जो किसी भी ऑडियो से पहले लक्ष्य भाषा सेट करता है:
{"प्रकार": "session.update", "session": { "आवाज": "टीना", "अनुवाद": {"भाषा": "en"}, "तौर-तरीके": ["पाठ", "ऑडियो"] }}
फिर माइक्रोफ़ोन ऑडियो को इस रूप में जोड़ें input_audio_buffer.append घटनाएँ। जैसे ही आप बोलते हैं मॉडल अनुवाद करता है और ऑडियो वापस स्ट्रीम करता है। इस मॉडल पर आवाजें टीना, सेरेना, एथन और सिंडी हैं। वैकल्पिक आईडी qwen3.8-livetranslate-flash-realtime उसी मॉडल को हल करता है। इस स्लग पर चैट-पूर्णता कॉल को अस्वीकार कर दिया जाता है; एकमात्र विज्ञापित समापन बिंदु सॉकेट है।
विचारशील
ओमनी फ्लैश पर, गहरी सोच डिफ़ॉल्ट रूप से चालू होती है और वापस स्ट्रीम होती है तर्क content उत्तर के साथ। इसे नियंत्रित करें सक्षम तथा thinking_budget (262,144 टोकन तक), या भेजें तर्क effort और प्लेटफ़ॉर्म इसे मॉडल के लिए बजट आकार में मैप करता है। टोकन को आउटपुट टोकन के रूप में सोचना, इसलिए सोच को अक्षम करें या छोटे, विलंबता-संवेदनशील मोड़ों के लिए एक छोटा बजट निर्धारित करें।
अंतर्निहित उपकरण
ओमनी फ्लैश पर वेब खोज पीछे की सवारी करती है TOKEN और डिफ़ॉल्ट रूप से बंद है। यह मॉडल वेब एक्सट्रैक्टर, कोड दुभाषिया या छवि-खोज टूल को उजागर नहीं करता है। जब खोज चलती है, तो प्रतिक्रिया की usage.tool_usage MAP रिपोर्ट करता है कि वास्तव में कितनी कॉल की गई थीं, ताकि आप प्रति-टूल बिलिंग का ऑडिट कर सकें. एक एकल अनुरोध खोज को एक से अधिक बार आमंत्रित कर सकता है और प्रत्येक कॉल का बिल भेजा जाता है. LiveTranslate में कोई वेब खोज नहीं है.
संरचित आउटपुट
Omni Flash पर सटीक प्रतिक्रिया आकार के लिए, पास करें response_format साथ {"प्रकार": "json_schema",...} तथा "सख्त": सच: मॉडल बिना किसी अतिरिक्त के स्कीमा की चाबियाँ लौटाता है। सादा JSON मोड के साथ {"प्रकार": "json_object"} भी समर्थित है।
आपकी पहली कॉल से पहले जानने लायक बातें
- ओमनी फ्लैश ऑडियो और वीडियो पढ़ता है, और यह पाठ में उत्तर देता है। ऑडियो आउटपुट का अनुरोध न करें। उस मॉडल पर कोई आवाज नियंत्रण नहीं है।
- Omni Flash ऑडियो को URL या base64 डेटा UI के रूप में भेजें। नेस्टेड
input_audio.डेटाएक URL या एक होना चाहिएडाटा:यूआरआई, कच्चा आधार नहीं64. एक playground एमपी3 अपलोड उपयोग करता हैप्रारूप: "एमपीईजी"; जिसका उपनामएमपी3।. tool_choice: "आवश्यक"सोच के दौरान काम नहीं करता है। अनुरोध एक स्पष्ट त्रुटि के साथ अस्वीकार कर दिया जाता है। रखनाtool_choice: "ऑटो"सोच सक्षम या सेट के साथenable_thinking: असत्यजब आपको किसी फ़ंक्शन कॉल को बाध्य करने की आवश्यकता होती है।- LiveTranslate को पहले सत्र में एक लक्ष्य भाषा की आवश्यकता होती है। इसके बिना किसी भी ऑडियो का उत्पादन करने से पहले सॉकेट बंद हो जाता है। ऑटो-डिटेक्ट करने के लिए स्रोत भाषा को अनसेट छोड़ दें।
दोनों मॉडल अब playground में और इसके माध्यम से उपलब्ध हैं EmpirioLabs एपीआई।.



