Qwen3.5 35B-A3B API

Qwen3.5 35B-A3B ist ein effizientes natives Vision-Sprachmodell mit spärlichem MoE-Routing, tiefem Denken und Text-, Bild- und Videoeingaben.

Alibaba CloudTextgenerierung256K KontextVeröffentlicht 24. Feb. 2026ChinaProprietärer Endpoint

Über Qwen3.5 35B-A3B

Qwen3.5 35B-A3B ist ein effizientes natives Vision-Sprachmodell mit spärlichem MoE-Routing, tiefem Denken und Text-, Bild- und Videoeingaben.

Unterstützt Text-, Bild- und Videoeingaben, Denkmodus, Funktionsaufruf, strukturierte Ausgabe und Websuche durch tool_web_search. Die Websuche fügt $0.01 pro Anfrage hinzu, wenn sie aktiviert ist. Denk-Token werden als Output-Token abgerechnet.

Auch bekannt als Alibaba Cloud Qwen3.5 35B-A3B, Qwen3.5-35B-A3B, qwen3-5-35b-a3b

reasoningvisionweb searchfunction callingmultimodal

Qwen3.5 35B-A3B Spezifikationen

Modell-ID
qwen3-5-35b-a3b
Anbieter
Alibaba Cloud
Kategorie
Textgenerierung
Veröffentlicht
24. Feb. 2026
Kontextfenster
256K Token
Max. Ausgabe
64.000 Token
Eingabe
TextBildVideo
Ausgabe
Text
Strukturierte Ausgabe
JSON-Modus
Region
China
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-35b-a3b:generateContent
Alternative Modell-IDs
qwen3.5-35b-a3b

Qwen3.5 35B-A3B API-PreiseSpare bis zu 77%

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M prompte Token
$0.25<=128K $0.057$0.25128K-256K $0.229
Ausgabe
pro 1M generierte Token
$2.00<=128K $0.459$2.00128K-256K $1.835
Web-Suche
pro Anfrage, wenn aktiviert
$0.01
Auf der vollständigen Preisseite vergleichen

So rufst du die Qwen3.5 35B-A3B API auf

Qwen3.5 35B-A3B bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID qwen3-5-35b-a3b. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-35b-a3b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-35b-a3b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige Qwen3.5 35B-A3B API-Referenz

Qwen3.5 35B-A3B API-Parameter

Request-Parameter, die die Qwen3.5 35B-A3B API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
temperaturenumber0.70 bis 2Temperatur wird geprochen. 0 ist deterministisch und 2 ist maximale Zufälligkeit.
top_pnumber0.90 bis 1Kernprobenwahrscheinlichkeitsmasse. Niedrigere Werte machen die Ausgaben fokussierter.
max_tokensnumber40961 bis 64000Maximale Ausgabe-Token.
stopstring--Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren.
enable_thinkingbooleantrue-Aktiviere das Schließen, bevor du antwortest.
reasoning_effortenummediumnone, low, medium, high, maxDer Aufwand des Schlussfolgerungsaufwands. Keiner verhindert das Denken. Niedrige, mittlere, hohe und maximale begrenzte Denkbudgets, die auf das gewählte Modell...
thinking_budgetnumber327681 bis 80000Maximale Token, die für das Denken beim Denken reserviert sind, ist aktiviert.
vl_high_resolution_imagesbooleantrue-Verwenden Sie eine höher aufgelöste Verarbeitung für Bildeingaben.
max_pixelsnumber26214404096 bis 16777216Maximale Pixelanzahl pro Bild, wenn hochauflösende Verarbeitung deaktiviert ist.
video_fpsnumber20.1 bis 10Bilder pro Sekunde, um von Videoeingängen abzutasten.
tool_web_searchbooleanfalse-Suchen Sie im Internet nach Echtzeitinformationen. Das erhöht $0.01 auf die Anforderungskosten, wenn es aktiviert ist.
response_formatenum--Geben Sie die Ausgabe als gültiges JSON-Objekt (JSON-Modus) zurück. Beschreibe die Felder, die du in deinem Prompt verwenden möchtest.

Gut zu wissen

Unterstützt Text-, Bild- und Videoeingaben. Die Websuche ist über tool_web_search verfügbar und fügt $0.01 bei aktivierter Anforderung hinzu. Denk-Token werden als Output-Token abgerechnet.

Qwen3.5 35B-A3B API: häufige Fragen

Wie viel kostet die Qwen3.5 35B-A3B API?

Auf EmpirioLabs wird Qwen3.5 35B-A3B nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von Qwen3.5 35B-A3B?

Qwen3.5 35B-A3B unterstützt ein Kontextfenster von 256K Token mit bis zu 64.000 Ausgabe-Token pro Antwort.

Ist die Qwen3.5 35B-A3B API OpenAI-kompatibel?

Ja. Qwen3.5 35B-A3B bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID qwen3-5-35b-a3b verwendest.

Kann ich Qwen3.5 35B-A3B im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Qwen3.5 35B-A3B im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Qwen3.5 35B-A3B API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.