Qwen3.5 Omni Flash API

Modèle omnimodal économique gérant texte, image, audio et vidéo, avec jusqu’à 3 heures d’audio et 1 heure de vidéo dans 90+ langues.

Alibaba CloudGénération de texte256K contextePublié 30 mars 2026SingaporeEndpoint propriétaire

À propos de Qwen3.5 Omni Flash

Modèle omnimodal économique gérant texte, image, audio et vidéo, avec jusqu’à 3 heures d’audio et 1 heure de vidéo dans 90+ langues.

Aussi connu sous le nom Alibaba Cloud Qwen3.5 Omni Flash

visionaudio inaudio outmultilingualfunction callingweb search

Caractéristiques de Qwen3.5 Omni Flash

ID du modèle
qwen3-5-omni-flash
Auteur
Alibaba Cloud
Catégorie
Génération de texte
Publié
30 mars 2026
Fenêtre de contexte
256K tokens
Sortie max
32 768 tokens
Entrée
TexteImageVidéoAudio
Sortie
TexteAudio
Sortie structurée
JSON Schema
Région
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/audio/speechPOST/v1beta/models/qwen3-5-omni-flash:generateContentPOST/v1/audio/speech:stream
Identifiants de modèle alternatifs
qwen3.5-omni-flash

Tarifs de l'API Qwen3.5 Omni Flash

Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.

Type
Spéc.
Tarif
Entrée
par 1M de jetons d’invite
per 1M prompt tokens $0.40per 1M prompt tokens $3.00
Produit
par 1M de jetons générés
per 1M generated tokens $2.20per 1M generated tokens $11.90
Recherche Web
par appel lors de l’invocation
$0.015
Comparer sur la page complète des tarifs

Comment appeler l'API Qwen3.5 Omni Flash

Qwen3.5 Omni Flash sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle qwen3-5-omni-flash. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-omni-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-omni-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Référence complète de l'API Qwen3.5 Omni Flash

Paramètres de l'API Qwen3.5 Omni Flash

Paramètres de requête pris en charge par l'API Qwen3.5 Omni Flash sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.

ParamètreTypePar défautPlage / valeursDescription
temperaturenumber0.70 à 2Température d’échantillonnage. 0 est déterministe et 2 est l’aléatoire maximal.
top_pnumber0.90 à 1Probabilité d’échantillonnage du noyau, masse. Des valeurs plus basses rendent les sorties plus ciblées.
max_tokensnumber40961 à 32768Jetons de sortie maximum.
output_modeenumtexttext, text_audioMode format de sortie. Texte = texte uniquement, audio = inclure la parole synthétisée.
voicestringTina-Nom vocal pour la sortie audio (quand output_mode = audio).
vl_high_resolution_imagesbooleantrue-Utilisez un traitement à haute résolution pour les entrées d’images.
max_pixelsnumber26214401 à 99999999Nombre maximal de pixels par image lorsque le traitement haute résolution est désactivé.
video_fpsnumber20.1 à 10Images par seconde pour échantillonner depuis les entrées vidéo.
tool_web_searchbooleanfalse-Cherchez sur internet des informations en temps réel. Ajoute $0.015 au coût de la requête pour chaque appel invoqué.
response_formatenum--Contraindre la sortie à un JSON valide. Utilisez le mode JSON pour n’importe quel objet JSON, ou fournissez un schéma JSON pour forcer une forme de réponse exacte.

Bon à savoir

Facturation audio - L’audio est facturé à un débit de jetons supérieur à celui de text/image/vidéo - Lorsque la sortie audio est activée, le texte de sortie n’est PAS facturé, seuls les jetons audio Voix et langue - 55 timbres vocaux disponibles - La sortie audio supporte 29 langues, 7 dialectes

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

API Qwen3.5 Omni Flash : questions fréquentes

Combien coûte l'API Qwen3.5 Omni Flash ?

Sur EmpirioLabs, Qwen3.5 Omni Flash est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.

Quelle est la fenêtre de contexte de Qwen3.5 Omni Flash ?

Qwen3.5 Omni Flash prend en charge une fenêtre de contexte de 256K tokens avec jusqu'à 32 768 tokens de sortie par réponse.

L'API Qwen3.5 Omni Flash est-elle compatible OpenAI ?

Oui. Qwen3.5 Omni Flash sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle qwen3-5-omni-flash.

Puis-je essayer Qwen3.5 Omni Flash dans le navigateur avant d'intégrer ?

Oui. Le playground EmpirioLabs exécute Qwen3.5 Omni Flash dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.

Comment obtenir une clé API Qwen3.5 Omni Flash ?

Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.