
Kosteneffizientes omnimodales Modell zur Bearbeitung von Text, Bild, Audio und Video mit bis zu 3 Stunden Audio und 1 Stunde Video in über 90 Sprachen.
Kosteneffizientes omnimodales Modell zur Bearbeitung von Text, Bild, Audio und Video mit bis zu 3 Stunden Audio und 1 Stunde Video in über 90 Sprachen.
Auch bekannt als Alibaba Cloud Qwen3.5 Omni Flash, Qwen3.5-Omni-Flash, qwen3-5-omni-flash
qwen3-5-omni-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/audio/speechPOST/v1beta/models/qwen3-5-omni-flash:generateContentqwen3.5-omni-flashLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Qwen3.5 Omni Flash bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID qwen3-5-omni-flash. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-5-omni-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-5-omni-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Qwen3.5 Omni Flash API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 bis 2 | Temperatur wird geprochen. 0 = deterministisch, 2 = maximale Zufälligkeit. |
| top_p | number | 0.9 | 0 bis 1 | Kernprobenwahrscheinlichkeitsmasse. Niedriger = fokussierter. |
| max_tokens | number | 4096 | 1 bis 32768 | Maximale Token in der Antwort. |
| output_mode | enum | text | text, text_audio | Ausgabeformatmodus. Text = nur Text, Audio = Synthetisierte Sprache enthalten. |
| voice | string | Tina | - | Sprachbezeichnung für Audioausgabe (wenn output_mode = Audio). |
| tool_web_search | boolean | false | - | Erlauben Sie dem Modell, bei Bedarf Websuchen durchzuführen. |
| video_fps | number | 2 | 0.1 bis 10 | Bilder pro Sekunde, die aus Eingabevideo zur Analyse abgeschnitten wurden. |
| vl_high_resolution_images | boolean | true | - | Verwenden Sie für Eingabebilder eine höhere Auflösung. Bessere Details zu höheren Kosten. |
| max_pixels | number | 2621440 | 1 bis 99999999 | Maximale Pixel pro Eingabebild. Größer = mehr Details, aber langsamer / mehr Token. |
| response_format | enum | - | - | Beschränke die Ausgabe auf JSON. Verwenden Sie den JSON-Modus für jedes gültige JSON-Objekt oder ein JSON-Schema, um eine Ausgabe zu erzwingen, die mit einem von... |
Audioabrechnung - Audio wird mit einer höheren Token-Rate abgerechnet als text/image /video - Wenn die Audioausgabe aktiviert ist, wird der Ausgabetext NICHT geladen - nur Audiotoken Voice und Sprache - 55 Sprachtöne verfügbar - Audioausgabe unterstützt 29 Sprachen, 7 Dialekte
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
Auf EmpirioLabs wird Qwen3.5 Omni Flash nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Qwen3.5 Omni Flash unterstützt ein Kontextfenster von 256K Token mit bis zu 32.768 Ausgabe-Token pro Antwort.
Ja. Qwen3.5 Omni Flash bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID qwen3-5-omni-flash verwendest.
Ja. Der EmpirioLabs Playground führt Qwen3.5 Omni Flash im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.