Qwen3.7 Max API

Qwen3.7 Max ist ein Flaggschiff-Textmodell für Codierung, Produktivität, langjährige Agenten, tiefes Denken, Tools und 1M-Token-Kontext.

Alibaba CloudTextgenerierung1M KontextVeröffentlicht 21. Mai 2026SingaporeProprietärer Endpoint

Über Qwen3.7 Max

Qwen3.7 Max ist ein Flaggschiff-Textmodell für Codierung, Produktivität, langjährige Agenten, tiefes Denken, Tools und 1M-Token-Kontext.

Unterstützt Texteingabe, Denkmodus mit enable thinking und thinking budget, Funktionsaufruf und drei integrierte Tools: tool_web_search, tool_web_extractor und tool_code_interpreter. Jeder integrierte Toolaufruf fügt $0.02 hinzu, wenn er aufgerufen wird. Denk-Token werden als Output-Token abgerechnet.

Auch bekannt als Alibaba Cloud Qwen3.7 Max, Qwen3.7-Max, qwen3-7-max

reasoningweb searchcode interpreterfunction callingagentic coding

Qwen3.7 Max Spezifikationen

Modell-ID
qwen3-7-max
Anbieter
Alibaba Cloud
Kategorie
Textgenerierung
Veröffentlicht
21. Mai 2026
Kontextfenster
1M Token
Max. Ausgabe
65.536 Token
Eingabe
Text
Ausgabe
Text
Strukturierte Ausgabe
JSON-Modus
Region
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-7-max:generateContent
Alternative Modell-IDs
qwen3.7-max

Qwen3.7 Max API-Preise

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M prompte Token
$2.50
Ausgabe
pro 1M generierte Token
$7.50
Web-Suche
pro Anruf beim Aufruf
$0.02
Webextraktor
pro Anruf beim Aufruf
$0.02
Code-Interpreter
pro Anruf beim Aufruf
$0.02
Auf der vollständigen Preisseite vergleichen

So rufst du die Qwen3.7 Max API auf

Qwen3.7 Max bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID qwen3-7-max. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-7-max",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-7-max",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige Qwen3.7 Max API-Referenz

Qwen3.7 Max API-Parameter

Request-Parameter, die die Qwen3.7 Max API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
temperaturenumber0.70 bis 2Temperatur wird geprochen. 0 ist deterministisch und 2 ist maximale Zufälligkeit.
top_pnumber0.90 bis 1Kernprobenwahrscheinlichkeitsmasse. Niedrigere Werte machen die Ausgaben fokussierter.
max_tokensnumber40961 bis 65536Maximale Ausgabe-Token.
stopstring--Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren.
enable_thinkingbooleantrue-Aktiviere das Schließen, bevor du antwortest.
reasoning_effortenummediumnone, low, medium, high, maxDer Aufwand des Schlussfolgerungsaufwands. Keiner verhindert das Denken. Niedrige, mittlere, hohe und maximale begrenzte Denkbudgets, die auf das gewählte Modell...
thinking_budgetnumber327681 bis 64000Maximale Token, die für das Denken beim Denken reserviert sind, ist aktiviert.
tool_web_searchbooleanfalse-Suchen Sie im Internet nach Echtzeitinformationen. Fügt $0.02 die Anfragekosten für jeden aufgerufenen Websuchaufruf hinzu.
tool_web_extractorbooleanfalse-Extrahieren und lesen Sie Inhalte aus URLs. Erfordert Websuche und Nachdenken. Fügt $0.02 die Anforderungskosten für jeden aufgerufenen Web-Extractor-Aufruf hinzu.
tool_code_interpreterbooleanfalse-Führe Python-Code in einer Sandbox aus. Erfordert Nachdenken. Fügt $0.02 zu den Anforderungskosten für jeden aufgerufenen Code-Interpreter-Aufruf hinzu.
disable_formattingbooleanfalse-Geben Sie rohe Ausgaben im Provider-Stil ohne EmpirioLabs Quellformatierung zurück, wo es unterstützt wird.
response_formatenum--Geben Sie die Ausgabe als gültiges JSON-Objekt (JSON-Modus) zurück. Beschreibe die Felder, die du in deinem Prompt verwenden möchtest.

Gut zu wissen

Nur Texteingabe. Web-Suche, Web-Extraktor und Code-Interpreter sind optionale integrierte Tools, die durch tool *-Parameter angezeigt werden. Jeder integrierte Toolaufruf fügt $0.02 hinzu, wenn er aufgerufen wird. Denk-Token werden als Output-Token abgerechnet.

Per-tool billing (usage.tool_usage)

When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.

:variant1

Nur Texteingabe. Websuche, Web-Extractor und Code-Interpreter sind optionale integrierte Tools, die über tool_*-Parameter bereitgestellt werden. Jeder eingebaute Toolaufruf fügt beim Aufruf $0.01 hinzu. Thinking Tokens werden als Output Tokens beworben.

Qwen3.7 Max Varianten

Varianten sind alternative Versionen von Qwen3.7 Max mit eigener Modell-ID. Je nach Variante können sich Serving-Region, Preise oder unterstützte Parameter unterscheiden; alles andere funktioniert gleich.

Qwen3.7 Max :variant1Spare bis zu 34%

Modell-ID
qwen3-7-max:variant1
Region
China
Kontextfenster
1M Token
Strukturierte Ausgabe
JSON-Modus
Batch API
Verfügbar, 35% Rabatt auf den Listenpreis
Typ
Spezifikation
Preis
Eingabe
pro 1M prompte Token
$2.50$1.65
Ausgabe
pro 1M generierte Token
$7.50$4.951
Web-Suche
pro Anruf beim Aufruf
$0.01
Webextraktor
pro Anruf beim Aufruf
$0.01
Code-Interpreter
pro Anruf beim Aufruf
$0.01
:variant1 im Playground testen

Qwen3.7 Max API: häufige Fragen

Wie viel kostet die Qwen3.7 Max API?

Auf EmpirioLabs wird Qwen3.7 Max nach Verbrauch abgerechnet: Input $2.50 pro 1M prompte Token; Output $7.50 pro 1M generierte Token; Web-Suche $0.02 pro Anruf beim Aufruf. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von Qwen3.7 Max?

Qwen3.7 Max unterstützt ein Kontextfenster von 1M Token mit bis zu 65.536 Ausgabe-Token pro Antwort.

Ist die Qwen3.7 Max API OpenAI-kompatibel?

Ja. Qwen3.7 Max bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID qwen3-7-max verwendest.

Welche Qwen3.7 Max Varianten sind verfügbar?

Qwen3.7 Max ist als 2 Modell-IDs verfügbar: der Standard qwen3-7-max plus qwen3-7-max:variant1 (China). Varianten können sich in Serving-Region, Preisen oder unterstützten Parametern unterscheiden; die Preistabellen stehen auf dieser Seite.

Kann ich Qwen3.7 Max im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Qwen3.7 Max im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Qwen3.7 Max API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.