
Schnelles Qwen3.6-Vision-Sprachmodell für agentische Codierung, mathematisches Denken, räumliches Verständnis, OCR sowie Text-, Bild- und Videoeingaben.
Schnelles Qwen3.6-Vision-Sprachmodell für agentische Codierung, mathematisches Denken, räumliches Verständnis, OCR sowie Text-, Bild- und Videoeingaben.
Unterstützt Text-, Bild- und Videoeingaben, Denkmodus mit enable thinking und thinking budget, Funktionsaufruf, strukturierte Ausgabe und Websuche durch tool_web_search. Die Websuche fügt $0.02 pro Abfrage hinzu, wenn sie aktiviert ist. Denk-Token werden als Output-Token abgerechnet. Explizite Cache-Steuerungen werden nicht unterstützt.
Auch bekannt als Alibaba Cloud Qwen3.6 Flash, Qwen3.6-Flash, qwen3-6-flash
qwen3-6-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-6-flash:generateContentqwen3.6-flashLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Qwen3.6 Flash bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID qwen3-6-flash. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-6-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-6-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Qwen3.6 Flash API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 bis 2 | Temperatur wird geprochen. 0 ist deterministisch und 2 ist maximale Zufälligkeit. |
| top_p | number | 0.9 | 0 bis 1 | Kernprobenwahrscheinlichkeitsmasse. Niedrigere Werte machen die Ausgaben fokussierter. |
| max_tokens | number | 4096 | 1 bis 65536 | Maximale Ausgabe-Token. |
| stop | string | - | - | Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren. |
| enable_thinking | boolean | true | - | Aktiviere das Schließen, bevor du antwortest. |
| reasoning_effort | enum | medium | none, low, medium, high, max | Der Aufwand des Schlussfolgerungsaufwands. Keiner verhindert das Denken. Niedrige, mittlere, hohe und maximale begrenzte Denkbudgets, die auf das gewählte Modell... |
| thinking_budget | number | 32768 | 1 bis 64000 | Maximale Token, die für das Denken beim Denken reserviert sind, ist aktiviert. |
| vl_high_resolution_images | boolean | true | - | Verwenden Sie eine höher aufgelöste Verarbeitung für Bildeingaben. |
| max_pixels | number | 2621440 | 4096 bis 16777216 | Maximale Pixelanzahl pro Bild, wenn hochauflösende Verarbeitung deaktiviert ist. |
| video_fps | number | 2 | 0.1 bis 10 | Bilder pro Sekunde, um von Videoeingängen abzutasten. |
| tool_web_search | boolean | false | - | Suchen Sie im Internet nach Echtzeitinformationen. Das erhöht $0.02 auf die Anforderungskosten, wenn es aktiviert ist. |
| response_format | enum | - | - | Geben Sie die Ausgabe als gültiges JSON-Objekt (JSON-Modus) zurück. Beschreibe die Felder, die du in deinem Prompt verwenden möchtest. |
Unterstützt Text-, Bild- und Videoeingaben. Die Websuche ist über tool_web_search verfügbar und fügt $0.02 pro Abfrage hinzu, wenn sie aktiviert ist. Denk-Token werden als Output-Token abgerechnet. Explizite Cache-Steuerungen werden nicht unterstützt.
:variant1
Unterstützt Text-, Bild- und Videoeingaben. Die Websuche ist über tool_web_search verfügbar und fügt $0.01 pro Abfrage hinzu, wenn sie aktiviert ist. Denk-Token werden als Output-Token abgerechnet. Explizite Cache-Steuerungen werden nicht unterstützt.
Varianten sind alternative Versionen von Qwen3.6 Flash mit eigener Modell-ID. Je nach Variante können sich Serving-Region, Preise oder unterstützte Parameter unterscheiden; alles andere funktioniert gleich.
qwen3-6-flash:variant1Auf EmpirioLabs wird Qwen3.6 Flash nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Qwen3.6 Flash unterstützt ein Kontextfenster von 1M Token mit bis zu 65.536 Ausgabe-Token pro Antwort.
Ja. Qwen3.6 Flash bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID qwen3-6-flash verwendest.
Qwen3.6 Flash ist als 2 Modell-IDs verfügbar: der Standard qwen3-6-flash plus qwen3-6-flash:variant1 (China). Varianten können sich in Serving-Region, Preisen oder unterstützten Parametern unterscheiden; die Preistabellen stehen auf dieser Seite.
Ja. Der EmpirioLabs Playground führt Qwen3.6 Flash im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.