
Modelo omnimodal econômico para lidar com texto, imagem, áudio e vídeo, com até 3 horas de áudio e 1 hora de vídeo em 90+ idiomas.
Modelo omnimodal econômico para lidar com texto, imagem, áudio e vídeo, com até 3 horas de áudio e 1 hora de vídeo em 90+ idiomas.
Também conhecido como Alibaba Cloud Qwen3.5 Omni Flash
qwen3-5-omni-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/audio/speechPOST/v1beta/models/qwen3-5-omni-flash:generateContentPOST/v1/audio/speech:streamqwen3.5-omni-flashTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Qwen3.5 Omni Flash atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo qwen3-5-omni-flash. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-5-omni-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-5-omni-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Qwen3.5 Omni Flash na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 a 2 | Temperatura de amostragem. 0 é determinístico e 2 é a aleatoriedade máxima. |
| top_p | number | 0.9 | 0 a 1 | Amostragem do núcleo com a probabilidade de massa. Valores mais baixos tornam as saídas mais focadas. |
| max_tokens | number | 4096 | 1 a 32768 | Tokens de saída máximos. |
| output_mode | enum | text | text, text_audio | Modo formato de saída. texto = apenas texto, áudio = incluir fala sintetizada. |
| voice | string | Tina | - | Nome da voz para saída de áudio (quando output_mode = áudio). |
| vl_high_resolution_images | boolean | true | - | Use processamento de resolução mais alta para entradas de imagem. |
| max_pixels | number | 2621440 | 1 a 99999999 | Contagem máxima de pixels por imagem quando o processamento de alta resolução está desativado. |
| video_fps | number | 2 | 0.1 a 10 | Frames por segundo para amostrar a partir das entradas de vídeo. |
| tool_web_search | boolean | false | - | Pesquise na internet por informações em tempo real. Adiciona $0.015 ao custo da solicitação para cada chamada invocada. |
| response_format | enum | - | - | Restringa a saída a JSON válido. Use o modo JSON para qualquer objeto JSON, ou forneça um Esquema JSON para forçar uma forma exata de resposta. |
Faturamento de áudio - O áudio é cobrado com uma taxa de token maior que text/image/vídeo - Quando a saída de áudio está ativada, o texto de saída NÃO é cobrado, apenas tokens de áudio Voz e idioma - 55 timbres de voz disponíveis - A saída de áudio suporta 29 idiomas, 7 dialetos
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
Na EmpirioLabs, Qwen3.5 Omni Flash é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Qwen3.5 Omni Flash suporta uma janela de contexto de 256K tokens com até 32.768 tokens de saída por resposta.
Sim. Qwen3.5 Omni Flash atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo qwen3-5-omni-flash.
Sim. O playground da EmpirioLabs executa Qwen3.5 Omni Flash no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.