
Multimodales Modell mit hybrider Architektur für effizientes tiefes Denken und visuelles Verständnis in Text, Bild und Video in einem 1M-Kontext.
Multimodales Modell mit hybrider Architektur für effizientes tiefes Denken und visuelles Verständnis in Text, Bild und Video in einem 1M-Kontext.
Auch bekannt als Alibaba Cloud Qwen3.5 Plus, Qwen3.5-Plus, qwen3-5-plus
qwen3-5-plus/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-plus:generateContentqwen3.5-plusLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Qwen3.5 Plus bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID qwen3-5-plus. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-5-plus",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-5-plus",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Qwen3.5 Plus API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 bis 2 | Temperatur wird geprochen. 0 = deterministisch, 2 = maximale Zufälligkeit. |
| top_p | number | 0.9 | 0 bis 1 | Kernprobenwahrscheinlichkeitsmasse. Niedriger = fokussierter. |
| max_tokens | number | 4096 | 1 bis 65536 | Maximale Token in der Antwort. |
| stop | string | - | - | Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren. |
| enable_thinking | boolean | true | - | Aktivieren Sie den erweiterten Denkmodus. Langsamere, aber verbesserte Aufgaben mit viel Schlussfolgerung. |
| vl_high_resolution_images | boolean | true | - | Verwenden Sie für Eingabebilder eine höhere Auflösung. Bessere Details zu höheren Kosten. |
| max_pixels | number | 2621440 | 1 bis 99999999 | Maximale Pixel pro Eingabebild. Größer = mehr Details, aber langsamer / mehr Token. |
| tool_web_search | boolean | false | - | Suchen Sie im Internet nach Echtzeitinformationen. |
| tool_web_extractor | boolean | true | - | Extrahieren und lesen Sie Inhalte aus URLs. Erfordert Websuche und Nachdenken. |
| tool_code_interpreter | boolean | true | - | Führe Python-Code in einer Sandbox aus. Erfordert Nachdenken. |
| tool_web_search_image | boolean | true | - | Suchen Sie im Internet nach Bildern aus Textbeschreibungen. |
| tool_image_search | boolean | true | - | Finden Sie ähnliche Bilder aus einem hochgeladenen Bild. |
| video_fps | number | 2 | 0.1 bis 10 | Bilder pro Sekunde, die aus Eingabevideo zur Analyse abgeschnitten wurden. |
| treat_images_as_video | boolean | false | - | Behandle eine Sequenz von Eingabebildern als Video zur zeitlichen Überlegung. |
Der Preis ist 3x für input/output über 256K Token. Eingebaute Tools (Websuche, Web-Extraktor, Code-Interpreter, Bildsuche) werden nur bei Aufruf in Rechnung gestellt. Text-to-Image Search und Image-to-Image Search verwenden die Preiszeile Image Search. Jede aufgerufene bildsuche wird mit dem angegebenen pro aufruf abgerechnet.
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
:variant1
Unterstützt Text-, Bild- und Videoeingaben. Die Websuche ist über tool_web_search verfügbar und fügt $0.01 pro Abfrage hinzu, wenn sie aktiviert ist. Denk-Token werden als Output-Token abgerechnet. Explizite Cache-Steuerungen werden nicht unterstützt.
Varianten sind alternative Versionen von Qwen3.5 Plus mit eigener Modell-ID. Je nach Variante können sich Serving-Region, Preise oder unterstützte Parameter unterscheiden; alles andere funktioniert gleich.
qwen3-5-plus:variant1Auf EmpirioLabs wird Qwen3.5 Plus nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Qwen3.5 Plus unterstützt ein Kontextfenster von 1M Token mit bis zu 65.536 Ausgabe-Token pro Antwort.
Ja. Qwen3.5 Plus bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID qwen3-5-plus verwendest.
Qwen3.5 Plus ist als 2 Modell-IDs verfügbar: der Standard qwen3-5-plus plus qwen3-5-plus:variant1 (China). Varianten können sich in Serving-Region, Preisen oder unterstützten Parametern unterscheiden; die Preistabellen stehen auf dieser Seite.
Ja. Der EmpirioLabs Playground führt Qwen3.5 Plus im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.