
Qwen3.7 Max ist ein Flaggschiff-Textmodell für Coding, Produktivität, langlaufende Agenten, tiefes Denken, Werkzeuge und 1M-Token-Kontext.
Qwen3.7 Max ist ein Flaggschiff-Textmodell für Coding, Produktivität, langlaufende Agenten, tiefes Denken, Werkzeuge und 1M-Token-Kontext.
Unterstützt Texteingabe, Denkmodus mit enable_thinking und thinking_budget, Funktionsaufrufe sowie drei integrierte Werkzeuge: tool_web_search, tool_web_extractor und tool_code_interpreter. Jeder eingebaute Toolaufruf fügt beim Aufruf $0.02 hinzu. Thinking Tokens werden als Output Tokens beworben.
Auch bekannt als Alibaba Cloud Qwen3.7 Max
qwen3-7-max/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-7-max:generateContentqwen3.7-maxLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Qwen3.7 Max bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID qwen3-7-max. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-7-max",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-7-max",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Qwen3.7 Max API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 bis 2 | Temperatur wird geprochen. 0 ist deterministisch und 2 ist maximale Zufälligkeit. |
| top_p | number | 0.9 | 0 bis 1 | Kernprobenwahrscheinlichkeitsmasse. Niedrigere Werte machen die Ausgaben fokussierter. |
| max_tokens | number | 4096 | 1 bis 65536 | Maximale Ausgabe-Token. |
| stop | string | - | - | Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren. |
| enable_thinking | boolean | true | - | Aktiviere das Schließen, bevor du antwortest. |
| reasoning_effort | enum | medium | none, low, medium, high, max | Der Aufwand des Schlussfolgerungsaufwands. Keiner verhindert das Denken. Niedrige, mittlere, hohe und maximale begrenzte Denkbudgets, die auf das gewählte Modell... |
| thinking_budget | number | 32768 | 1 bis 64000 | Maximale Token, die für das Denken beim Denken reserviert sind, ist aktiviert. |
| tool_web_search | boolean | false | - | Suchen Sie im Internet nach Echtzeitinformationen. Fügt $0.02 die Anfragekosten für jeden aufgerufenen Aufruf hinzu. |
| tool_web_extractor | boolean | false | - | Extrahieren und lesen Sie Inhalte aus URLs. Erfordert Websuche und Nachdenken. Fügt $0.02 die Anfragekosten für jeden aufgerufenen Aufruf hinzu. |
| tool_code_interpreter | boolean | false | - | Führe Python-Code in einer Sandbox aus. Erfordert Nachdenken. Fügt $0.02 die Anfragekosten für jeden aufgerufenen Aufruf hinzu. |
| disable_formatting | boolean | false | - | Geben Sie rohe Ausgaben im Provider-Stil ohne EmpirioLabs Quellformatierung zurück, wo es unterstützt wird. |
| response_format | enum | - | - | Beschränkt die Ausgabe auf gültiges JSON. Verwenden Sie den JSON-Modus für jedes JSON-Objekt oder stellen Sie ein JSON-Schema bereit, um eine exakte Antwortform zu... |
Nur Texteingabe. Websuche, Web-Extractor und Code-Interpreter sind optionale integrierte Tools, die über tool_*-Parameter bereitgestellt werden. Jeder eingebaute Toolaufruf fügt beim Aufruf $0.02 hinzu. Thinking Tokens werden als Output Tokens beworben.
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
:variant1
Nur Texteingabe. Websuche, Web-Extractor und Code-Interpreter sind optionale integrierte Tools, die über tool_*-Parameter bereitgestellt werden. Jeder eingebaute Toolaufruf fügt beim Aufruf $0.01 hinzu. Thinking Tokens werden als Output Tokens beworben.
Varianten sind alternative Versionen von Qwen3.7 Max mit eigener Modell-ID. Je nach Variante können sich Serving-Region, Preise oder unterstützte Parameter unterscheiden; alles andere funktioniert gleich.
qwen3-7-max:variant1Auf EmpirioLabs wird Qwen3.7 Max nach Verbrauch abgerechnet: Eingabe $2.50 pro 1M Prompt-Token; Output $7.50 pro 1 Million generierter Token; Web-Suche $0.02 pro Aufruf beim Aufruf. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Qwen3.7 Max unterstützt ein Kontextfenster von 1M Token mit bis zu 65.536 Ausgabe-Token pro Antwort.
Ja. Qwen3.7 Max bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID qwen3-7-max verwendest.
Qwen3.7 Max ist als 2 Modell-IDs verfügbar: der Standard qwen3-7-max plus qwen3-7-max:variant1 (China). Varianten können sich in Serving-Region, Preisen oder unterstützten Parametern unterscheiden; die Preistabellen stehen auf dieser Seite.
Ja. Der EmpirioLabs Playground führt Qwen3.7 Max im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.