Precificação

Pague conforme você vai ou escolha um plano com auxílios semanais.

Catálogo de preços

Precificação de modelos de IA as-you-go pagos.

Os preços da EmpirioLabs variam conforme o modelo e a unidade: tokens, imagens, segundos de áudio ou vídeo, mensagens, ativos 3D e solicitações de busca. A tabela de preços interativa carrega o catálogo atual, enquanto essas taxas representativas permanecem legíveis sem JavaScript do cliente.

Documentação do modelo aberto

As tarifas da API de modelos são exibidas e cobradas em USD. O checkout pode mostrar métodos de pagamento locais quando elegíveis.

Kling 3.0 Turbo

Kling AILançado 17 de jun. de 2026Geração de Vídeo
Endpoint proprietário

Texto-para-vídeo e image-to-video com áudio nativo sincronizado, em 720p ou 1080p por 3 a 15 segundos, com relação de aspecto e controle de prompt.

Tipo
Especificação
Tarifa
720p
por segundo
$0.18
1080p
por segundo
$0.225

GLM 5.2

Z.aiSingaporeLançado 16 de jun. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Raciocínio e modelo de codificação com um contexto de token 1M, saída 128K, esforço de raciocínio ajustável, busca nativa web e chamada de ferramenta.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.40
Saída
por tokens gerados 1M
$4.40
Pesquisa Web
por pedido
$0.033

GLM 5.2

Z.aiGermanyLançado 16 de jun. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 21%

Raciocínio e modelo de codificação com um contexto de token 1M, saída 128K, esforço de raciocínio ajustável, busca nativa web e chamada de ferramenta.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.40$1.10
Saída
por tokens gerados 1M
$4.40$3.851
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.275
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Kimi K3

Moonshot AIInternationalLançado 15 de jul. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Kimi K3 é o modelo principal de raciocínio da Moonshot, com contexto de token 1M, pensamento sempre ativo, busca nativa na web e entradas de texto, imagem e vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$3.00
Saída
por tokens gerados 1M
$15.00
Pesquisa Web
por chamada quando invocado
$0.015

Muse Spark 1.2

Meta AILançado 5 de ago. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

O modelo atualizado de raciocínio fronteiriço da Meta com um contexto de 1.048.576 tokens, entendimento de imagem, vídeo, áudio e PDF, busca na web e uso de ferramentas.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.25
Saída
por tokens gerados 1M
$4.25
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$1.00
Pesquisa Web
por consulta de busca
$0.00825

Kimi K2.7 Code

Moonshot AIInternationalLançado 16 de jun. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Kimi K2.7 O código é o modelo de codificação agentic trilião-parâmetro de Moonshot com 256K contexto, sempre em raciocínio, e texto, imagem, e entradas de vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.95
Saída
por tokens gerados 1M
$4.00
Pesquisa Web
por chamada quando invocado
$0.015

Kimi K2.7 Code

Moonshot AIGermanyLançado 16 de jun. de 2026Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 7%

Kimi K2.7 O código é o modelo de codificação agentic trilião-parâmetro de Moonshot com 256K contexto, sempre em raciocínio, e texto, imagem, e entradas de vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.95$0.8939
Saída
por tokens gerados 1M
$4.00$3.7131
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.1788
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Muse Spark 1.1

Meta AILançado 9 de jul. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo de raciocínio metafrontier com um contexto de 1.048.576 tokens, além de entendimento de imagens, vídeos, áudio e PDF, busca na web e uso de ferramentas.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.25
Saída
por tokens gerados 1M
$4.25
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$1.00
Pesquisa Web
por consulta de busca
$0.00825

Fugu Ultra v1.1

Sakana AILançado 23 de jul. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Condutor multiagente atualizado para raciocínio rigoroso, codificação e pesquisa, com esforço máximo distinto, contexto 1M, entrada de imagem e busca na web.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=272K $5.00>272K $10.00
Saída
por tokens gerados 1M
<=272K $30.00>272K $45.00
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
<=272K $0.50>272K $1.00

Qwen3.7 Plus

Alibaba CloudSingaporeLançado 1 de jun. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo de linguagem de visão Qwen3.7 econômico para texto, imagem, vídeo, codificação, uso de ferramentas, compreensão de GUI e fluxos de trabalho de 1M-contexto.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=256K $0.40256K-1M $1.20
Saída
por tokens gerados 1M
<=256K $1.60256K-1M $4.80
Pesquisa Web
por chamada quando invocado
$0.03
Busca texto para imagem
por chamada quando invocado
$0.03
Busca imagem a imagem
por chamada quando invocado
$0.03
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

Qwen3.7 Plus

Alibaba CloudChinaLançado 1 de jun. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 31%

Modelo de linguagem de visão Qwen3.7 econômico para texto, imagem, vídeo, codificação, uso de ferramentas, compreensão de GUI e fluxos de trabalho de 1M-contexto.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.40<=256K $0.276$1.20256K-1M $0.826
Saída
por tokens gerados 1M
$1.60<=256K $1.101$4.80256K-1M $3.301
Leu a 'cache' implícita
por fichas em cache de 1M
$0.08<=256K $0.056$0.24256K-1M $0.166
Pesquisa Web
por chamada quando invocado
$0.01
Busca texto para imagem
por chamada quando invocado
$0.01
Busca imagem a imagem
por chamada quando invocado
$0.01
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

Kimi K2.7 Code Highspeed

Moonshot AIInternationalLançado 16 de jun. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Kimi K2.7 O Code Highspeed é o nível de serviço mais rápido do modelo de codificação agentic da Moonshot, com 256K de contexto, sempre em raciocínio e entrada de imagem e vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.90
Saída
por tokens gerados 1M
$8.00
Pesquisa Web
por chamada quando invocado
$0.015

Fugu Ultra v1.0

Sakana AILançado 21 de jun. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Condutor multiagente original para raciocínio rigoroso, codificação e pesquisa, com contexto 1M, entrada de imagem, chamada de funções e busca na web.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=272K $7.50>272K $15.00
Saída
por tokens gerados 1M
<=272K $45.00>272K $67.50
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
<=272K $1.50>272K $3.00

Qwen3.7 Flash

Alibaba CloudSingaporeLançado 15 de jul. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo de linguagem visual rápido Qwen3.7 para tarefas de texto, imagem, vídeo, uso de ferramentas e agentes, com cache implícito e contexto de token de 1M.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=32K $0.0332K-256K $0.10256K-1M $0.20
Saída
por tokens gerados 1M
<=32K $0.1332K-256K $0.40256K-1M $0.80
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
<=32K $0.00632K-256K $0.02256K-1M $0.04
Pesquisa Web
por chamada quando invocado
$0.03
Busca texto para imagem
por chamada quando invocado
$0.03
Busca imagem a imagem
por chamada quando invocado
$0.03
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

Qwen3.7 Flash

Alibaba CloudChinaLançado 15 de jul. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 18%

Modelo de linguagem visual rápido Qwen3.7 para tarefas de texto, imagem, vídeo, uso de ferramentas e agentes, com cache implícito e contexto de token de 1M.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.03<=32K $0.028$0.1032K-256K $0.083$0.20256K-1M $0.165
Saída
por tokens gerados 1M
$0.13<=32K $0.11$0.4032K-256K $0.33$0.80256K-1M $0.66
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
<=32K $0.006$0.0232K-256K $0.017$0.04256K-1M $0.033
Pesquisa Web
por chamada quando invocado
$0.01
Busca texto para imagem
por chamada quando invocado
$0.01
Busca imagem a imagem
por chamada quando invocado
$0.01
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

MiniMax M3

MiniMaxSingaporeLançado 1 de jun. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 25%

MiniMax M3 é um modelo de raciocínio multimodal para codificação, agentes e análise de contexto longo com texto, imagem e entrada de vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.30<=512K $0.225$0.60>512K $0.45
Saída
por tokens gerados 1M
$1.20<=512K $0.90$2.40>512K $1.80
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.06<=512K $0.045$0.12>512K $0.09
Busca na Web (Linkup)
por chamada quando invocado
$0.013

MiniMax M3

MiniMaxSingaporeLançado 1 de jun. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 25%

MiniMax M3 é um modelo de raciocínio multimodal para codificação, agentes e análise de contexto longo com texto, imagem e entrada de vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.45<=512K $0.3375$0.90>512K $0.675
Saída
por tokens gerados 1M
$1.80<=512K $1.35$3.60>512K $2.70
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.09<=512K $0.0675$0.18>512K $0.135
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Qwen3.7 Max

Alibaba CloudSingaporeLançado 21 de mai. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Qwen3.7 Max é um modelo de texto emblemático para codificação, produtividade, agentes de longo prazo, pensamento profundo, ferramentas e contexto de 1M-token.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.50
Saída
por tokens gerados 1M
$7.50
Pesquisa Web
por chamada quando invocado
$0.02
Extractor Web
por chamada quando invocado
$0.02
Interpretador de código
por chamada quando invocado
$0.02

Qwen3.7 Max

Alibaba CloudChinaLançado 21 de mai. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 34%

Qwen3.7 Max é um modelo de texto emblemático para codificação, produtividade, agentes de longo prazo, pensamento profundo, ferramentas e contexto de 1M-token.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.50$1.65
Saída
por tokens gerados 1M
$7.50$4.951
Pesquisa Web
por chamada quando invocado
$0.01
Extractor Web
por chamada quando invocado
$0.01
Interpretador de código
por chamada quando invocado
$0.01

Qwen3.8 Max

Alibaba CloudSingaporeLançado 3 de ago. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

O MoE principal em escala trilionária para programação, agentes de longo prazo e trabalhos profissionais, com compreensão de imagem e vídeo em um contexto de 1 milhão de tokens.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.00
Saída
por tokens gerados 1M
$6.00
Pesquisa Web
por chamada quando invocado
$0.02
Busca texto para imagem
por chamada quando invocado
$0.02
Busca imagem a imagem
por chamada quando invocado
$0.02
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

Qwen3.8 Max

Alibaba CloudChinaLançado 3 de ago. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 18%

O MoE principal em escala trilionária para programação, agentes de longo prazo e trabalhos profissionais, com compreensão de imagem e vídeo em um contexto de 1 milhão de tokens.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.00$1.65
Saída
por tokens gerados 1M
$6.00$4.951
Pesquisa Web
por chamada quando invocado
$0.01
Busca texto para imagem
por chamada quando invocado
$0.01
Busca imagem a imagem
por chamada quando invocado
$0.01
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

ACE-Step 1.5 XL

ACE-StepLançado 2 de abr. de 2026Geração de Áudio
Inferência Nativa
Save up to 17%

Modelo de geração de música de código aberto para text-to-song e áudio guiado por letras, com rápida inferência XL Turbo de 8 passos para iterações de músicas controláveis.

Tipo
Especificação
Tarifa
Geração de música
por segundo gerado
$0.0003$0.00025

FLUX.2 Klein 4B

Black Forest LabsLançado 15 de jan. de 2026Geração de Imagens
Inferência Nativa
Save up to 39%

Licença Apache 4B FLUX.2 Modelo de geração e edição de imagens Klein com text-to-image, edição de imagem de referência e suporte ao fluxo de trabalho criativo.

Tipo
Especificação
Tarifa
Geração de imagens
por imagem
$0.014$0.0085

MiniMax M2.7 Highspeed

MiniMaxSingaporeLançado 18 de mar. de 2026Ctx 200KGeração de Texto
Endpoint proprietário
Save up to 50%

Variante M2.7 de alta velocidade sintonizada para inferência rápida com forte desempenho de propósito geral com fortes capacidades de agente.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.60$0.30
Saída
por tokens gerados 1M
$2.40$1.20
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.06$0.03
Busca na Web (Linkup)
por chamada quando invocado
$0.013

TTS 2

InworldLançado 5 de mai. de 2026Geração de Áudio
Endpoint proprietário
Save up to 12%

Modelo de voz em tempo real com direção de voz em inglês simples, uma identidade de voz em 100+ idiomas e time-to-first-audio de streaming abaixo de 200ms.

Tipo
Especificação
Tarifa
Síntese
por 1M caracteres
$25.00$22.00

TTS 1.5 Mini

InworldLançado 21 de jan. de 2026Geração de Áudio
Endpoint proprietário
Save up to 30%

Sub-130ms TTFB síntese de voz com 271+ vozes em 15 idiomas, prosódia expressiva e streaming em tempo real para agentes de voz de baixa latência.

Tipo
Especificação
Tarifa
Síntese
por 1M caracteres
$25.00$17.50

TTS 1.5 Max

InworldLançado 21 de jan. de 2026Geração de Áudio
Endpoint proprietário
Save up to 15%

Síntese de voz de qualidade de transmissão com prosódia expressiva rica, 271+ vozes em 15 idiomas e streaming em tempo real de SSE com datas por palavra.

Tipo
Especificação
Tarifa
Síntese
por 1M caracteres
$35.00$29.75

GLM 5.1

Z.aiChinaLançado 7 de abr. de 2026Ctx 202KGeração de Texto
Endpoint proprietário
Save up to 41%

Modelo de raciocínio Zhipu AI de contexto longo com contexto 202K, saída 128K, chamada de ferramentas, saída estruturada e suporte a cache.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.40<=32K $0.825$1.4032K-200K $1.10
Saída
por tokens gerados 1M
$4.40<=32K $3.301$4.4032K-200K $3.851
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.26<=32K $0.165$0.2632K-200K $0.22
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Kimi K2.6

Moonshot AIChinaLançado 20 de abr. de 2026Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 7%

Kimi K2.6 é um modelo de raciocínio multimodal Moonshot com 256K de contexto, codificação forte e entradas de texto, imagem e vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.95$0.8939
Saída
por tokens gerados 1M
$4.00$3.7131
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.1788
Busca na Web (Linkup)
por chamada quando invocado
$0.013

DeepSeek V4 Flash 0731

DeepSeekGermanyLançado 31 de jul. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Lançamento pós-treinado do 0731 com grandes ganhos em programação, trabalho com repositórios, uso de ferramentas e tarefas full-stack, além de uma janela de contexto de 1M.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.14
Saída
por tokens gerados 1M
$0.28
Busca na Web (Linkup)
por chamada quando invocado
$0.013

MiniMax M2.7

MiniMaxSingaporeLançado 18 de mar. de 2026Ctx 200KGeração de Texto
Endpoint proprietário
Save up to 50%

MiniMax M2.7 é um modelo de chat de raciocínio de propósito geral com pensamento interleaved, função chamando, e caching prompt.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.30$0.15
Saída
por tokens gerados 1M
$1.20$0.60
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.06$0.03
Busca na Web (Linkup)
por chamada quando invocado
$0.013

TRELIS.2 4B

MicrosoftGeração 3D
Inferência Nativa
Save up to 90%

TRELLIS.2 modelo imagem-para-3D que transforma uma imagem de referência em um ativo GLB texturizado com resolução, semente, malha, textura e controles de exportação.

Tipo
Especificação
Tarifa
512 activos
por pedido
$0.25$0.025
1024 activos
por pedido
$0.30$0.249
1536 activo
por pedido
$0.499

Qwen3.5 122B-A10B

Alibaba CloudChinaLançado 24 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 71%

Qwen3.5 122B-A10B é um modelo de raciocínio multimodal com contexto 256K, inferência de MoE esparsa eficiente, texto, imagem e entrada de vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.40<=128K $0.115$0.40128K-256K $0.287
Saída
por tokens gerados 1M
$3.20<=128K $0.917$3.20128K-256K $2.294
Pesquisa Web
por chamada quando invocado
$0.01

Qwen3.5 397B-A17B

Alibaba CloudChinaLançado 16 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 71%

Qwen3.5 397B-A17B é um modelo de raciocínio multimodal emblemático para linguagem, código, agentes, tarefas GUI e compreensão de imagens e vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.60<=128K $0.172$0.60128K-256K $0.43
Saída
por tokens gerados 1M
$3.60<=128K $1.032$3.60128K-256K $2.58
Pesquisa Web
por chamada quando invocado
$0.01

Qwen3.5 35B-A3B

Alibaba CloudChinaLançado 24 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 77%

Qwen3.5 35B-A3B é um modelo eficiente de linguagem de visão nativa com roteamento de MoE esparso, pensamento profundo e entrada de texto, imagem e vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.25<=128K $0.057$0.25128K-256K $0.229
Saída
por tokens gerados 1M
$2.00<=128K $0.459$2.00128K-256K $1.835
Pesquisa Web
por chamada quando invocado
$0.01

Qwen3.5 27B

Alibaba CloudChinaLançado 24 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 71%

Qwen3.5 27B é um modelo de raciocínio multimodal denso com respostas rápidas, contexto 256K e compreensão de texto, imagem e vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.30<=128K $0.086$0.30128K-256K $0.258
Saída
por tokens gerados 1M
$2.40<=128K $0.688$2.40128K-256K $2.064
Pesquisa Web
por chamada quando invocado
$0.01

Qwen3.6 27B

Alibaba CloudChinaLançado 22 de abr. de 2026Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 31%

Qwen3.6 27B melhora a codificação agente, raciocínio STEM, visão espacial, OCR, texto, imagem e compreensão de vídeo no contexto 256K.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.60$0.412564
Saída
por tokens gerados 1M
$3.60$2.475384
Pesquisa Web
por chamada quando invocado
$0.01

Qwen3.6 Flash

Alibaba CloudSingaporeLançado 16 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo rápido de linguagem de visão Qwen3.6 para codificação agente, raciocínio matemático, compreensão espacial, OCR, texto, imagem e entrada de vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=256K $0.25256K-1M $1.00
Saída
por tokens gerados 1M
<=256K $1.50256K-1M $4.00
Pesquisa Web
por chamada quando invocado
$0.02

Qwen3.6 Flash

Alibaba CloudChinaLançado 16 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 34%

Modelo rápido de linguagem de visão Qwen3.6 para codificação agente, raciocínio matemático, compreensão espacial, OCR, texto, imagem e entrada de vídeo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.25<=256K $0.165$1.00256K-1M $0.66
Saída
por tokens gerados 1M
$1.50<=256K $0.99$4.00256K-1M $3.961
Pesquisa Web
por chamada quando invocado
$0.01

Gemma 4 26B-A4B

GoogleLançado 31 de mar. de 2026Ctx 256KGeração de Texto
Inferência Nativa
Save up to 83%

Gemma 4 26B A4B é um modelo multimodal aberto do Google com 256K de contexto, texto, imagem e entrada de vídeo, ferramentas e saída estruturada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.15$0.05
Saída
por tokens gerados 1M
$0.50$0.29
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.15$0.025
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Qwen3.5 9B

Alibaba CloudLançado 23 de fev. de 2026Ctx 256KGeração de Texto
Inferência Nativa
Save up to 13%

Qwen3.5 9B é um modelo de raciocínio multimodal compacto com 256K de contexto, entrada de imagem e vídeo, ferramentas de função e saída estruturada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.10$0.09
Saída
por tokens gerados 1M
$0.15$0.13
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.045
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Qwen3.5 4B

Alibaba CloudLançado 2 de mar. de 2026Ctx 256KGeração de Texto
Inferência Nativa

Qwen3.5 4B é um modelo de raciocínio multimodal de baixo custo com 256K de contexto, entrada de imagem e vídeo, ferramentas de função e saída estruturada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.04
Saída
por tokens gerados 1M
$0.07
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.02
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Qwen3.6 35B A3B

Alibaba CloudLançado 16 de abr. de 2026Ctx 128KGeração de Texto
Inferência Nativa
Save up to 72%

Qwen3.6 35B A3B é um modelo de raciocínio mixture-of-experts com 256 especialistas em raciocínio, com contexto de 128K, ferramentas funcionais e saída JSON estruturada e estritamente estruturada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.248$0.07
Saída
por tokens gerados 1M
$1.485$0.42
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.035
Busca na Web (Linkup)
por chamada quando invocado
$0.013

GLM 4.7 Flash

Z.aiSingaporeLançado 19 de jan. de 2026Ctx 200KGeração de Texto
Endpoint proprietário

Modelo de texto GLM-4.7 leve gratuito para codificação, raciocínio, escrita de longo contexto e chat geral.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
Grátis
Saída
por tokens gerados 1M
Grátis
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
Grátis
Pesquisa Web
por solicitação quando habilitado
$0.033

GLM 4.5 Flash

Z.aiSingaporeLançado 28 de jul. de 2025Ctx 200KGeração de Texto
Endpoint proprietário

Modelo de texto GLM-4.5 leve livre para raciocínio, codificação, chat de longa duração e tarefas de linguagem geral.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
Grátis
Saída
por tokens gerados 1M
Grátis
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
Grátis
Pesquisa Web
por solicitação quando habilitado
$0.033

GLM 4.6V Flash

Z.aiSingaporeLançado 8 de dez. de 2025Ctx 128KGeração de Texto
Endpoint proprietário

Modelo multimodal GLM-4.6V gratuito para imagem, vídeo, arquivo e compreensão de texto com chamada de função nativa.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
Grátis
Saída
por tokens gerados 1M
Grátis
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
Grátis
Pesquisa Web
por solicitação quando habilitado
$0.033

Amazon Nova Canvas

AmazonLançado 3 de dez. de 2024Geração de Imagens
Endpoint proprietário

Modelo de geração e edição de imagens criando e modificando imagens a partir de entradas de texto ou imagem, com inpinting, virtual try-on, e controles de estilo.

Tipo
Especificação
Tarifa
Padrão Pequeno (≤1024×1024)
por imagem
$0.12
Prémio Pequeno (≤1024×1024)
por imagem
$0.18
Padrão Grande (≤2048×2048)
por imagem
$0.18
Prémio Grande (≤2048×2048)
por imagem
$0.24

Amazon Nova Reel 1.1

AmazonLançado 7 de abr. de 2025Geração de Vídeo
Endpoint proprietário

Modelo de geração de vídeo produzindo até 2 minutos de vídeos multi-shot de texto e avisos de imagem opcionais com melhor qualidade e consistência.

Tipo
Especificação
Tarifa
Por segundo
por segundo
$0.14

Deepgram Nova 3

DeepgramLançado 12 de fev. de 2025Transcrição
Endpoint proprietário

Transcrição de fala-texto utilizando o modelo Nova-3 com suporte multilíngue e configurações personalizáveis avançadas para cargas de trabalho de produção.

Tipo
Especificação
Tarifa
Transcrição
por minuto de áudio
$0.014

DeepReasoning

WinFuncLançado 26 de jan. de 2025Geração de Texto
Endpoint proprietário

Pares DeepSeek R1 chain-of-thought raciocínio com a criação Anthropic Claude e geração de código atrás de uma interface unificada, controlada por dados.

Tipo
Especificação
Tarifa
R1-0528 + Claude Sonnet 4.5 (Padrão)
por fichas de 1K
In $0.012 / Out $0.058
R1-0528 + Claude Haiku 4.5
por fichas de 1K
In $0.0048 / Out $0.023
R1-0528 + Claude Opus 4.5
por fichas de 1K
In $0.019 / Out $0.092
R1-0528 + Claude Sonnet 4
por fichas de 1K
In $0.012 / Out $0.058
R1-0528 + Claude Opus 4.1
por fichas de 1K
In $0.053 / Out $0.26
R1-0528 + Claude Opus 4
por fichas de 1K
In $0.053 / Out $0.26
Busca na Web (Linkup)
por chamada quando invocado
$0.013

DeepSeek V3.2

DeepSeekSingaporeLançado 1 de dez. de 2025Ctx 128KGeração de Texto
Endpoint proprietário

Open-source Mixture-of-Experts LLM sintonizado para raciocínio de alta eficiência, codificação e tarefas gerais de linguagem em prompts de longa forma.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.57
Saída
por tokens gerados 1M
$1.71
Pesquisa Web
por solicitação quando habilitado
$0.015

DeepSeek V4 Flash

DeepSeekGermanyLançado 24 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo MoE leve com 284B total / 13B parâmetros ativos e contexto nativo de 1M, sintonizado para uso de alta concorrência de baixa latência e econômico.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.14
Saída
por tokens gerados 1M
$0.28
Busca na Web (Linkup)
por chamada quando invocado
$0.013

DeepSeek V4 Flash

DeepSeekSingaporeLançado 24 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo MoE leve com 284B total / 13B parâmetros ativos e contexto nativo de 1M, sintonizado para uso de alta concorrência de baixa latência e econômico.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.20
Saída
por tokens gerados 1M
$0.40
Pesquisa Web
por solicitação quando habilitado
$0.02

DeepSeek V4 Flash

DeepSeekChinaLançado 24 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 2%

Modelo MoE leve com 284B total / 13B parâmetros ativos e contexto nativo de 1M, sintonizado para uso de alta concorrência de baixa latência e econômico.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.14$0.138
Saída
por tokens gerados 1M
$0.28$0.275
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.028
Pesquisa Web
por solicitação quando habilitado
$0.01

DeepSeek V4 Pro

DeepSeekGermanyLançado 24 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 5%

Flagship MoE LLM com 1.6T total / 49B parâmetros ativos e contexto nativo 1M para matemática avançada, inferência lógica e codificação especializada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.74$1.65
Saída
por tokens gerados 1M
$3.48$3.30
Busca na Web (Linkup)
por chamada quando invocado
$0.013

DeepSeek V4 Pro

DeepSeekSingaporeLançado 24 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Flagship MoE LLM com 1.6T total / 49B parâmetros ativos e contexto nativo 1M para matemática avançada, inferência lógica e codificação especializada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.40
Saída
por tokens gerados 1M
$4.80
Pesquisa Web
por solicitação quando habilitado
$0.02

DeepSeek V4 Pro

DeepSeekChinaLançado 24 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 5%

Flagship MoE LLM com 1.6T total / 49B parâmetros ativos e contexto nativo 1M para matemática avançada, inferência lógica e codificação especializada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.74$1.65
Saída
por tokens gerados 1M
$3.48$3.301
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.138
Pesquisa Web
por solicitação quando habilitado
$0.01

Exa Answer

ExaPesquisa e Pesquisa
Endpoint proprietário

Resposta rápida ao estilo LLM a uma questão de linguagem natural, fundamentada em resultados de busca recente da web Exa com citações em linha e links de origem.

Tipo
Especificação
Tarifa
Resposta
por pedido
$0.01

Gemini 2.5 Flash TTS

GoogleLançado 20 de mai. de 2025Geração de Áudio
Endpoint proprietário

Baixa latência text-to-speech com vozes mono e multi-falantes e estilo controlável, sotaque e tom expressivo para aplicativos de produção.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.50
Saída
por tokens gerados 1M
$30.00

Gemini 2.5 Pro TTS

GoogleLançado 20 de mai. de 2025Geração de Áudio
Endpoint proprietário

Pré-visualização TTS de alta qualidade para podcasts, audiolivros e suporte ao cliente, com vozes expressivas multi-falantes em mais de 23 idiomas.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$3.00
Saída
por tokens gerados 1M
$60.00

Gemini 3.1 Flash TTS

GoogleLançado 13 de abr. de 2026Geração de Áudio
Endpoint proprietário

TTS altamente controlável com novas etiquetas de áudio para estilo preciso, tom, ritmo e entrega através de narração, assistentes e aplicativos de voz.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.60
Saída
por tokens gerados 1M
$52.00

Gemma 3 27B

GoogleLançado 10 de mar. de 2025Ctx 128KGeração de Texto
Endpoint proprietário

Modelo vision-language de código aberto com contexto 128K, 140+ linguagens, melhorado math/reasoning, saídas estruturadas e chamada de função.

Tipo
Especificação
Tarifa
Por mensagem
fixado
$0.0040
Busca na Web (Linkup)
por chamada quando invocado
$0.013

GLM TTS

Z.aiLançado 11 de dez. de 2025Geração de Áudio
Inferência Nativa

LLM-based text-to-speech com clonagem de voz zero de 3-10s de áudio e emoção-expressiva, saída controlável através de RL multi-recompensa.

Tipo
Especificação
Tarifa
Rápido (INT8)
por 1k caracteres
$0.20
Qualidade (FP16)
por 1k caracteres
$0.21

GPTZero

GPTZeroFerramentas & Agentes
Endpoint proprietário

Detector de aprendizagem profunda que sinaliza porções de texto provavelmente geradas por IA versus humanos, classificando o conteúdo como inteiramente humano, IA ou misto.

Tipo
Especificação
Tarifa
Digitalização de Texto
por 1.000 palavras
$0.39

HappyHorse 1.0

Alibaba CloudSingaporeLançado 6 de mai. de 2026Geração de Vídeo
Endpoint proprietário

Modelo de vídeo que oferece os modos Texto-para-Video, Imagem-para-Vídeo, Referência-para-Vídeo e Edição de Vídeo com alta fidelidade, movimento-saída.

Tipo
Especificação
Tarifa
Todos os Modos 720P
por segundo
$0.14
Todos os Modos 1080P
por segundo
$0.24

Hunyuan Image 3

TencentLançado 28 de set. de 2025Geração de Imagens
Endpoint proprietário

Open-source text-to-image modelo em uma arquitetura multimodal Mixture-of-Experts com detalhes fotorealistas e forte renderização de texto multilingue.

Tipo
Especificação
Tarifa
Padrão
por imagem
$0.13

Hunyuan Video 1.5

TencentLançado 20 de nov. de 2025Geração de Vídeo
Inferência Nativa
Save up to 19%

Modelo de vídeo de 8,3B-parâmetros com saída nativa de 720p (upcalable a 1080p), forte coerência de movimento, e entendimento rápido bilíngue até 10s.

Tipo
Especificação
Tarifa
480p
por segundo
$0.075$0.061
720p
por segundo
$0.29
1080p (reforço)
por segundo
$0.67

Janus-Pro DeepSeek

DeepSeekLançado 27 de jan. de 2025Geração de Imagens
Endpoint proprietário

Framework autorregressivo no modelo Janus Pro 7B que unifica compreensão multimodal e geração de imagem em uma arquitetura.

Tipo
Especificação
Tarifa
Geração de Imagens
por imagem
$0.030
Análise de Imagens
por imagem enviada
$0.030

Kling O3

Kling AILançado 5 de fev. de 2026Geração de Vídeo
Endpoint proprietário

Modelo de vídeo em modos Standard ou Pro com transições de Texto para Vídeo, Imagem para Vídeo, Referência para Vídeo, edição, som nativo e multi-cena.

Tipo
Especificação
Tarifa
Padrão T2V/I2V
por segundo
$0.168
Padrão T2V/I2V Som
por segundo
$0.224
Entrada de Vídeo Padrão
por segundo
$0.252
Pro T2V/I2V
por segundo
$0.224
Pro T2V/I2V Som
por segundo
$0.280
Entrada de Vídeo Pro
por segundo
$0.336
4K T2V/I2V /ref
por segundo
$0.525

Kling v3 Motion Control

Kling AIGeração de Vídeo
Endpoint proprietário

Modelo Kling 3.0 que transfere movimento de um vídeo de referência para um caractere de uma imagem de referência, com níveis Standard 720p e Pro 1080p.

Tipo
Especificação
Tarifa
Padrão (720p)
por segundo
$0.14
Pro (1080p)
por segundo
$0.18

Linkup Standard

LinkupCtx 100KPesquisa e Pesquisa
Endpoint proprietário

Pesquisa web com tecnologia de IA com visão geral e respostas detalhadas, mais rápido do que a pesquisa profunda. Ranks #1 no OpenAI SimpleQA benchmark.

Tipo
Especificação
Tarifa
Por mensagem
fixado
$0.013

Mistral Medium 3

Mistral AILançado 7 de mai. de 2025Ctx 130KGeração de Texto
Endpoint proprietário

Modelo de linguagem custo-eficiente oferecendo forte raciocínio e desempenho multimodal para cargas de trabalho de produção geral em latência competitiva.

Tipo
Especificação
Tarifa
Por mensagem
fixado
$0.015
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Mistral Medium 3.1

Mistral AILançado 12 de ago. de 2025Ctx 131KGeração de Texto
Endpoint proprietário

Modelo de nível empresarial com forte raciocínio, codificação e desempenho STEM, suportando implantações híbridas, on-prem e in-VPC.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.52
Saída
por tokens gerados 1M
$2.60
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Mistral Small 3.1

Mistral AILançado 17 de mar. de 2025Ctx 128KGeração de Texto
Endpoint proprietário

Modelo multimodal 24B-parâmetro com contexto 128K para análise de imagens, programação, matemática e tarefas multilingues, sintonizadas para inferência local eficiente.

Tipo
Especificação
Tarifa
Por mensagem
fixado
$0.0019
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Mistral Small 4

Mistral AILançado 16 de mar. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo híbrido unificando as famílias Instrução, Raciocínio (Magistral) e Devstral: 40% menor tempo de conclusão e 3x rendimento vs Small 3.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.15
Saída
por tokens gerados 1M
$0.60
Pesquisa Padrão na Web
por chamada
$0.084
Pesquisa Web Premium
por chamada
$0.140
Interpretador de Código
por chamada
$0.084
Geração de Imagens
por imagem
$0.280

MOSS Video and Audio

OpenMOSSLançado 29 de jan. de 2026Geração de Vídeo
Inferência Nativa

Modelo de fundação Open-source 32B MoE que gera vídeo sincronizado e áudio em uma etapa de inferência com dupla torre precisa de sincronia labial.

Tipo
Especificação
Tarifa
Vídeo 360p
por vídeo
$0.17
Vídeo 720p
por vídeo
$2.82
T2V Rápido
taxa adicional
$0.065
Qualidade T2V
taxa adicional
$0.13

Nova Lite 1.0

AmazonLançado 3 de dez. de 2024Ctx 300KGeração de Texto
Endpoint proprietário

Modelo de fundação multimodal de baixo custo para texto, imagens e vídeo em um contexto de 300K (até ~ 30 minutos de vídeo), sintonizado para velocidade e acessibilidade.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.069
Saída
por tokens gerados 1M
$0.28
Entrada em 'cache'
por fichas de 1M
$0.0386
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Nova Lite 2

AmazonLançado 2 de dez. de 2025Ctx 1MGeração de Texto
Endpoint proprietário

Modelo de raciocínio multimodal rápido e econômico para texto, imagens, documentos e vídeo em um contexto de 1M (docs longos e clipes de ~90 min).

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.38
Saída
por tokens gerados 1M
$3.16
Entrada em 'cache'
por fichas de 1M
$0.2128
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Nova Micro 1.0

AmazonLançado 3 de dez. de 2024Ctx 128KGeração de Texto
Endpoint proprietário

Modelo de fundação somente texto sintonizado para latência ultra-baixa e custo no contexto 128K. Forte para resumo, tradução e bate-papo com 44% de desconto de cache.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.040
Saída
por tokens gerados 1M
$0.16
Entrada em 'cache'
por fichas de 1M
$0.0224
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Nova Premier 1.0

AmazonLançado 30 de abr. de 2025Ctx 1MGeração de Texto
Endpoint proprietário

Modelo mais capaz na família. Multimodal text/image /vídeo em um contexto de 1M com chain-of-thought raciocínio entre ferramentas e fontes de dados.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$3.00
Saída
por tokens gerados 1M
$15.00
Entrada em 'cache'
por fichas de 1M
$1.68
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Nova Pro 1.0

AmazonLançado 3 de dez. de 2024Ctx 300KGeração de Texto
Endpoint proprietário

Modelo de fundação multimodal balanceamento precisão, velocidade e custo para texto, imagens e vídeo em 300K contexto (até ~ 30 minutos de vídeo).

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.40
Saída
por tokens gerados 1M
$9.60
Entrada otimizada de latência
por fichas de alerta de 1M
$3.00
Saída otimizada de latência
por tokens gerados 1M
$12.00
Busca na Web (Linkup)
por chamada quando invocado
$0.013

OpenAI Whisper 1

OpenAILançado 21 de set. de 2022Transcrição
Endpoint proprietário

Whisper-1 speech-to-text transcrição treinada em áudio supervisionado multilingue, com um limite de upload de 25 MB por arquivo.

Tipo
Especificação
Tarifa
Por minuto de áudio
por minuto
$0.030

Perplexity Advanced Deep Research

PerplexityPesquisa e Pesquisa
Endpoint proprietário

Pesquisa de nível institucional baseada no raciocínio de Claude Opus 4.6, com profundidade máxima, acesso aprimorado a ferramentas e ampla cobertura de fontes.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$12.00
Saída
por tokens gerados 1M
$60.00
Chamada de Pesquisa Web
por chamada
$0.012
URL Obter Chamada
por chamada
$0.0012

Perplexity Deep Research

PerplexityCtx 128KPesquisa e Pesquisa
Endpoint proprietário

Modelo de pesquisa para recuperação, síntese e raciocínio em várias etapas, busca, leitura e avaliação autônoma de fontes em tópicos complexos.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$4.80
Saída
por tokens gerados 1M
$19.00
Citações
por fichas de 1M
$4.80
Raciocínios
por fichas de 1M
$7.20
Pesquisar Consultas
por consulta
$0.012

Perplexity Sonar

PerplexityCtx 127KPesquisa e Pesquisa
Endpoint proprietário

Pesquisa web em tempo real com citações precisas e fontes personalizáveis para up-to-date Integração de pesquisa de IA em aplicativos de produção.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.40
Saída
por tokens gerados 1M
$2.40
Taxa de base (baixo contexto)
por pedido
$0.012
Taxa de base (Contexto Médio)
por pedido
$0.019
Taxa de base (alto contexto)
por pedido
$0.029

Perplexity Sonar Pro

PerplexityCtx 200KPesquisa e Pesquisa
Endpoint proprietário

Modelo pesquisado com o dobro das citações e uma janela de contexto maior, sintonizado para consultas complexas que necessitam de respostas aprofundadas e nuances.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$7.20
Saída
por tokens gerados 1M
$36.00
Taxa de base (baixo contexto)
por pedido
$0.014
Taxa de base (Contexto Médio)
por pedido
$0.024
Taxa de base (alto contexto)
por pedido
$0.034

Perplexity Sonar Reasoning Pro

PerplexityCtx 128KPesquisa e Pesquisa
Endpoint proprietário

Raciocínio de modelo no código aberto sem censura R1-1776 com pesquisa web, superando motores de busca líderes e LLMs no simpleQA benchmark.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$4.80
Saída
por tokens gerados 1M
$19.00
Taxa de base (baixo contexto)
por pedido
$0.014
Taxa de base (Contexto Médio)
por pedido
$0.024
Taxa de base (alto contexto)
por pedido
$0.034

Pixverse v5

PixVerseLançado 29 de ago. de 2025Geração de Vídeo
Endpoint proprietário

Geração de vídeo cinematográfico em modos Texto-Vídeo, Imagem-Vídeo e Transição com alto detalhe, movimento fluido e animações realistas.

Tipo
Especificação
Tarifa
360p/540p 5s
por vídeo
$0.45
360p/540p 8s
por vídeo
$0.90
720p 5s
por vídeo
$0.60
720p 8s
por vídeo
$1.20
1080p 5s
por vídeo
$1.20

Pixverse v5.6

PixVerseLançado 26 de jan. de 2026Geração de Vídeo
Endpoint proprietário

Gera vídeos de texto ou imagem de 1-2 imagens de molduras até 1080p, múltiplas proporções de aspecto, 5-10s durações, com áudio sincronizado opcional.

Tipo
Especificação
Tarifa
360p/540p 5s sem áudio
por vídeo
$0.40
360p/540p 5s áudio
por vídeo
$0.80
360p/540p 8s sem áudio
por vídeo
$0.80
360p/540p 8s áudio
por vídeo
$1.60
360p/540p 10s sem áudio
por vídeo
$0.88
360p/540p 10s áudio
por vídeo
$1.76
720p 5s sem áudio
por vídeo
$0.65
Áudio 720p 5s
por vídeo
$1.30
720p 8s sem áudio
por vídeo
$1.30
Áudio 720p 8s
por vídeo
$2.60
720p 10s sem áudio
por vídeo
$1.43
Áudio 720p 10s
por vídeo
$2.86
1080p 5s sem áudio
por vídeo
$0.75
Áudio 1080p 5s
por vídeo
$1.50
1080p 8s sem áudio
por vídeo
$1.50
Áudio 1080p 8s
por vídeo
$3.00

Qwen Image 2.0

Alibaba CloudSingaporeLançado 3 de mar. de 2026Geração de Imagens
Endpoint proprietário

Modelo unificado de geração e edição de imagens com complexo líder de classe Chinese/English renderização de texto, texturas realistas e fusão multi-imagem.

Tipo
Especificação
Tarifa
Padrão
por imagem
$0.035
Pro
por imagem
$0.075

Qwen Image 3.0

Alibaba CloudSingaporeLançado 21 de jul. de 2026Geração de Imagens
Endpoint proprietário

Geração e edição de imagens Qwen com variantes Base e Pro, tipografia multilíngue, referências multi-imagem e saída controlável em 1K ou 2K.

Tipo
Especificação
Tarifa
Saída Base (1K ou 2K)
por imagem
$0.030
Saída Pro de até 2,25MP (1K)
por imagem
$0.040
Saída Pro acima de 2,25MP (2K)
por imagem
$0.075
Imagem de Entrada (1K ou 2K)
por imagem de entrada
$0.003

Qwen3.5 Flash

Alibaba CloudSingaporeLançado 24 de fev. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 10%

Modelo de linguagem de visão com atenção linear híbrida mais MoE esparsa, contexto 1M, e inferência multimodal rápida text/image /video.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.10$0.090
Saída
por tokens gerados 1M
$0.40$0.368
Pesquisa Web
por chamada quando invocado
$0.015
Busca texto para imagem
por chamada quando invocado
$0.012
Busca imagem a imagem
por chamada quando invocado
$0.012
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

Qwen3.5 Flash

Alibaba CloudChinaLançado 24 de fev. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 68%

Modelo de linguagem de visão com atenção linear híbrida mais MoE esparsa, contexto 1M, e inferência multimodal rápida text/image /video.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.090<=128K $0.029128K-256K $0.115256K-1M $0.172
Saída
por tokens gerados 1M
$0.368<=128K $0.287128K-256K $1.147256K-1M $1.72
Pesquisa Web
por chamada quando invocado
$0.01

Qwen3.5 Omni Flash

Alibaba CloudSingaporeLançado 30 de mar. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo omnimodal custo-eficiente lidar com texto, imagem, áudio e vídeo, com até 3 horas de áudio e 1 hora de vídeo em mais de 90 idiomas.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
per 1M prompt tokens $0.40per 1M prompt tokens $3.00
Saída
por tokens gerados 1M
per 1M generated tokens $2.20per 1M generated tokens $11.90
Pesquisa Web
por chamada quando invocado
$0.015

Qwen3.5 Omni Plus

Alibaba CloudSingaporeLançado 30 de mar. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo omnimodal Flagship para texto, imagem, áudio e vídeo. 3h áudio, 1h vídeo, 90+ entrada e 30+ linguagens de saída, 55 timbres de voz.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
per 1M prompt tokens $1.40per 1M prompt tokens $11.00
Saída
por tokens gerados 1M
per 1M generated tokens $8.30per 1M generated tokens $44.00
Pesquisa Web
por chamada quando invocado
$0.015

Qwen3.5 Plus

Alibaba CloudSingaporeLançado 16 de fev. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 10%

Modelo multimodal com arquitetura híbrida para um pensamento profundo eficiente e compreensão visual através de texto, imagem e vídeo em um contexto 1M.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.40<=256K $0.36$1.20256K-1M $1.08
Saída
por tokens gerados 1M
$2.40<=256K $2.21$7.20256K-1M $6.62
Pesquisa Web
por chamada quando invocado
$0.015
Busca texto para imagem
por chamada quando invocado
$0.012
Busca imagem a imagem
por chamada quando invocado
$0.012
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

Qwen3.5 Plus

Alibaba CloudChinaLançado 16 de fev. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 69%

Modelo multimodal com arquitetura híbrida para um pensamento profundo eficiente e compreensão visual através de texto, imagem e vídeo em um contexto 1M.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.36<=128K $0.115$0.36128K-256K $0.287$1.08256K-1M $0.573
Saída
por tokens gerados 1M
$2.21<=128K $0.688$2.21128K-256K $1.72$6.62256K-1M $3.44
Pesquisa Web
por chamada quando invocado
$0.01

Qwen3.6 Max Preview

Alibaba CloudSingaporeLançado 20 de abr. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Maior variante de pré-visualização na série 3.6 (somente texto): execução melhorada do agente de codificação, habilidades front-end mais fortes e conhecimento de cauda longa mais amplo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=128K $1.31128K-256K $1.97
Saída
por tokens gerados 1M
<=128K $7.88128K-256K $11.82
Pesquisa Web
por chamada quando invocado
$0.020

Qwen3.6 Plus

Alibaba CloudSingaporeLançado 2 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo de linguagem de visão com grandes atualizações acima de 3.5: codificação agente e front-end, reconhecimento multimodal, OCR e localização de objetos.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=256K $0.50256K-1M $2.00
Saída
por tokens gerados 1M
<=256K $3.00256K-1M $6.00
Pesquisa Web
por chamada quando invocado
$0.026
Busca texto para imagem
por chamada quando invocado
$0.0208
Busca imagem a imagem
por chamada quando invocado
$0.0208
Extractor Web
por chamada quando invocado
$0.00
Interpretador de código
por chamada quando invocado
$0.00

Qwen3.6 Plus

Alibaba CloudChinaLançado 2 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário
Save up to 45%

Modelo de linguagem de visão com grandes atualizações acima de 3.5: codificação agente e front-end, reconhecimento multimodal, OCR e localização de objetos.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.50<=256K $0.276$2.00256K-1M $1.101
Saída
por tokens gerados 1M
$3.00<=256K $1.651256K-1M $6.602
Pesquisa Web
por chamada quando invocado
$0.01

Qwen3 Max

Alibaba CloudSingaporeLançado 23 de set. de 2025Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 10%

256K-context emblemático com grandes melhorias no raciocínio, instrução seguindo, e suporte multilingue, mais maior coding/math precisão.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
Saída
por tokens gerados 1M
$6.00<=32K $5.52$12.0032K-128K $11.04$15.00128K-256K $13.80
Pesquisa Web
por chamada quando invocado
$0.015

Qwen3 Max Preview

Alibaba CloudSingaporeLançado 5 de set. de 2025Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 20%

Lançamento de visualização com grandes ganhos sobre a série 2.5 no entendimento chinês-inglês, instruções complexas, habilidade multilíngue e uso de ferramentas.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
Saída
por tokens gerados 1M
$6.00<=32K $4.80$12.0032K-128K $9.60$15.00128K-256K $12.00
Pesquisa Web
por chamada quando invocado
$0.015

Qwen3 Max Thinking

Alibaba CloudSingaporeLançado 23 de set. de 2025Ctx 256KGeração de Texto
Endpoint proprietário
Save up to 10%

Modelo de raciocínio com uso de ferramenta adaptativa (pesquisa, memória, intérprete de código) e escala de tempo de teste para maior precisão em tarefas complexas.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
Saída
por tokens gerados 1M
$6.00<=32K $5.52$12.0032K-128K $11.04$15.00128K-256K $13.80
Pesquisa Web
por chamada quando invocado
$0.015

Qwen3 Rerank

Alibaba CloudSingaporeLançado 5 de jun. de 2025Ctx 4KReclassificadores
Endpoint proprietário

Reavaliador de documentos semânticos. Ordena até 500 candidatos por consulta por relevância, suporta mais de 100 idiomas e aceita uma instrução de ordenação personalizada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.10

Seed 2.0 Code

ByteDanceMalaysiaLançado 14 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo de contexto de 256K codificado com resultados front-end fortes e suporte de programação multilingue para ferramentas e agentes de codificação de IA.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=128K $0.40128K-256K $0.80
Saída
por tokens gerados 1M
<=128K $2.40128K-256K $4.80

Seed 2.0 Lite

ByteDanceMalaysiaLançado 14 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo geral balanceado para cargas de trabalho empresariais de alta frequência: processamento de informações, conteúdo, pesquisa e análise de dados.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=128K $0.31128K-256K $0.62
Saída
por tokens gerados 1M
<=128K $2.50128K-256K $5.00

Seed 2.0 Mini

ByteDanceMalaysiaLançado 14 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo multimodal focado em latência com contexto 256K, quatro modos de esforço de raciocínio e image/video para uso de alta concorrência.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=128K $0.12128K-256K $0.24
Saída
por tokens gerados 1M
<=128K $0.50128K-256K $1.00

Seed 2.0 Pro

ByteDanceMalaysiaLançado 14 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo geral de flagship com contexto 256K para raciocínio complexo, compreensão multimodal, geração estruturada e execução aumentada por ferramentas.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=128K $0.63128K-256K $1.26
Saída
por tokens gerados 1M
<=128K $3.79128K-256K $7.58

Seedance 2.0 Fast

ByteDanceMalaysiaLançado 12 de fev. de 2026Geração de Vídeo
Endpoint proprietário

Velocidade otimizada 2.0 variante de vídeo para clipes cinematográficos com sincronização de áudio nativo, controle de câmera e movimento estável a menor custo por renderização.

Tipo
Especificação
Tarifa
T2V/I2V 480P
por segundo
$0.122
T2V/I2V 720P
por segundo
$0.260
Entrada de vídeo 480P
por segundo
$0.284
Entrada de vídeo 720P
por segundo
$0.610

Seedance 2.0 Pro

ByteDanceMalaysiaLançado 12 de fev. de 2026Geração de Vídeo
Endpoint proprietário

Modelo de vídeo multimodal para saída cinematográfica de entradas de texto, imagem, áudio ou vídeo, com movimento estável e caracteres consistentes.

Tipo
Especificação
Tarifa
T2V/I2V 480P
por segundo
$0.139
T2V/I2V 720P
por segundo
$0.300
T2V/I2V 1080P
por segundo
$0.749
T2V/I2V 4K
por segundo
$1.555
Entrada de vídeo 480P
por segundo
$0.342
Entrada de vídeo 720P
por segundo
$0.736
Entrada de vídeo 1080P
por segundo
$1.841
Entrada de Vídeo 4K
por segundo
$3.732

Seedream 5.0 Lite

ByteDanceMalaysiaLançado 13 de fev. de 2026Geração de Imagens
Endpoint proprietário

Modelo de imagem multimodal unificado que raciocina através de prompts antes da renderização, produzindo edições de alta resolução e consistentes e visuais de marca.

Tipo
Especificação
Tarifa
Padrão
por imagem
$0.0350

Seedream 5.0 Pro

ByteDanceMalaysiaLançado 8 de jul. de 2026Geração de Imagens
Endpoint proprietário

Modelo de imagem Premium Seedream para text-to-image, edições e fusão multirreferencial com saída de 1K, 1,5K e 2K, além de otimização padrão ou rápida de prompts.

Tipo
Especificação
Tarifa
Potência de até 2,61MP
por imagem
$0.075
Potência acima de 2,61MP
por imagem
$0.150
Imagem extra de entrada
por imagem de entrada após a primeira
$0.005

SoulX Podcast

Soul AI LabLançado 29 de out. de 2025Geração de Áudio
Inferência Nativa

Modelo de voz de código aberto para diálogo de podcast multi-falante de forma longa com controle paralinguístico (risos, suspiros) e clonagem de voz de tiro zero.

Tipo
Especificação
Tarifa
Base
por 1k caracteres
$0.015
Dialeto
por 1k caracteres
$0.015

Stable Audio 2.0

Stability AILançado 3 de abr. de 2024Geração de Áudio
Endpoint proprietário

Gera áudio até 3 minutos das instruções de texto, suportando text-to-audio e audio-to-audio com duração ajustável, etapas e escala CFG.

Tipo
Especificação
Tarifa
Custo base
por geração
$0.58
Por Custo Passo
por etapa
$0.00

Stable Audio 2.5

Stability AILançado 10 de set. de 2025Geração de Áudio
Endpoint proprietário

Up to-3-minute áudio de texto com text-to-audio, audio-to-audio, e inpintura de áudio para produção de música, design de som e remixing.

Tipo
Especificação
Tarifa
Geração
por geração
$0.68

SVI 2.0 Pro

VITA-Group / EPFLLançado 26 de dez. de 2025Geração de Vídeo
Inferência Nativa

Vídeo estável Infinity 2.0 Pro na WAN 2.2: estende imagens paradas em vídeo teoricamente infinito, mantendo IDs de caracteres consistentes.

Tipo
Especificação
Tarifa
Vídeo 480p
por segundo
$0.057
Vídeo 720p
por segundo
$0.17
T2V Rápido
taxa adicional
$0.065
Qualidade T2V
taxa adicional
$0.13

Tavily Research

TavilyPesquisa e Pesquisa
Endpoint proprietário

Assistente de pesquisa multipesquisa que explora um tema, analisa fontes e produz um relatório detalhado de pesquisa com citações.

Tipo
Especificação
Tarifa
Mini
média por tarefa
~$1.19
Pro
média por tarefa
~$2.75

Text Embedding v4

Alibaba CloudSingaporeLançado 4 de jun. de 2025Ctx 8KIncorporações
Endpoint proprietário

Texto multilingue incorporado com dimensões de saída selecionáveis (64-2048). Até 8.192 tokens por entrada.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.07

Tongyi Embedding Vision Flash

Alibaba CloudSingaporeLançado 23 de set. de 2025Ctx 1KIncorporações
Endpoint proprietário

Incorporação multimodal otimizada por velocidade - da mesma forma que Vision-Plus, 3× mais barato image/video.

Tipo
Especificação
Tarifa
Entrada de texto
por fichas de 1M
$0.09
Imagem / entrada de vídeo
por fichas de 1M
$0.03

Tongyi Embedding Vision Plus

Alibaba CloudSingaporeLançado 23 de set. de 2025Ctx 1KIncorporações
Endpoint proprietário

Incorporação multimodal produzindo vetores independentes para entradas de texto, imagem e vídeo.

Tipo
Especificação
Tarifa
Entrada de texto
por fichas de 1M
$0.09
Imagem / entrada de vídeo
por fichas de 1M
$0.09

Wan 2.6

Alibaba CloudSingaporeLançado 12 de jan. de 2026Geração de Vídeo
Endpoint proprietário

Modelo de geração de vídeo multimodal para histórias cinematográficas, multi-shot com sincronização audiovisual nativa (lip-sync, diálogo, música, SFX).

Tipo
Especificação
Tarifa
Padrão 720P
por segundo
$0.10
Padrão 1080P
por segundo
$0.15
Flash 720P (áudio)
por segundo
$0.050
Flash 720P (sem áudio)
por segundo
$0.0250
Flash 1080P (áudio)
por segundo
$0.0750
Flash 1080P (sem áudio)
por segundo
$0.03750

Wan 2.7

Alibaba CloudSingaporeLançado 26 de abr. de 2026Geração de Vídeo
Endpoint proprietário

Modelo de vídeo multimodal suportando T2V, I2V, edição de vídeo e reference-to-video, com saída de alta fidelidade de entrada de texto, imagem ou vídeo.

Tipo
Especificação
Tarifa
Todos os Modos 720P
por segundo
$0.10
Todos os Modos 1080P
por segundo
$0.150

Wan2.7 Image

Alibaba CloudSingaporeLançado 1 de abr. de 2026Geração de Imagens
Endpoint proprietário

Modelo companheiro de geração e edição de imagens: text-to-image, edições da caixa-limite e conjuntos de imagens coesas, com até 4K de saída no Pro.

Tipo
Especificação
Tarifa
Padrão
por imagem
$0.030
Pro
por imagem
$0.075

Whisper Large v3 Turbo

OpenAILançado 1 de out. de 2024Transcrição
Inferência Nativa
Save up to 17%

Transcrição controlada Whisper Large v3 Turbo com ASR multilíngue, tradução, VAD, carimbos de tempo, legendas, hotwords e controles de decodificador.

Tipo
Especificação
Tarifa
Transcrição controlada
por minuto de áudio
$0.006$0.005

Manus

ManusFerramentas & Agentes
Endpoint proprietário

Agente de IA autônomo que transforma um prompt de alto nível em subtarefas, ferramentas de chamadas e APIs e oferece resultados end-to-end sem orquestração manual.

Tipo
Especificação
Tarifa
Adaptativo - Manus 1.6 Lite
por tarefa
$1.44 - $2.63
Adaptativo - Manus 1.6
por tarefa
$2.89 - $5.25
Adaptativo - Manus 1.6 Max
por tarefa
$5.25 - $9.19

Grok Imagine Video 1.5

xAILançado 16 de jun. de 2026Geração de Vídeo
Endpoint proprietário

Geração de texto para vídeo, image-to-video e reference-to-video com até sete imagens de referência para caracteres consistentes, até 15 segundos em 1080p.

Tipo
Especificação
Tarifa
480p
por segundo
$0.096
720p
por segundo
$0.168
1080p
por segundo
$0.300
Entrada da imagem
por imagem
$0.05

MiMo V2.5 Pro

XiaomiLançado 27 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo de topo para fluxos de trabalho agenticos, engenharia complexa de software e tarefas de longo horizonte, sustentando o trabalho em mais de 1000 chamadas de ferramentas no contexto de 1M.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$2.175
Saída
por tokens gerados 1M
$4.35
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.018
Pesquisa Web
por solicitação quando habilitado
$0.015

MiMo V2.5

XiaomiLançado 22 de abr. de 2026Ctx 1MGeração de Texto
Endpoint proprietário

Modelo multimodal com compreensão visual e áudio nativo em um contexto de 1M, projetado para raciocinar e agir através de modalidades em fluxos de trabalho agentes.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.70
Saída
por tokens gerados 1M
$1.40
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.014
Pesquisa Web
por solicitação quando habilitado
$0.015

HappyHorse 1.1

Alibaba CloudSingaporeLançado 22 de jun. de 2026Geração de Vídeo
Endpoint proprietário

Texto, imagem e reference-to-video em um único modelo. Movimento cinematográfico, consistência dos personagens em até 9 referências e áudio nativo sincronizado.

Tipo
Especificação
Tarifa
720p
por segundo
$0.14
1080p
por segundo
$0.18

Seedance 2.0 Mini

ByteDanceMalaysiaLançado 15 de jun. de 2026Geração de Vídeo
Endpoint proprietário

O nível Seedance 2.0 mais rápido e acessível para clipes curtos de cinema, com áudio nativo, controle de câmera e entradas de imagem ou vídeo em 480p e 720p.

Tipo
Especificação
Tarifa
T2V/I2V 480P
por segundo
$0.070
T2V/I2V 720P
por segundo
$0.150
Entrada de vídeo 480P
por segundo
$0.167
Entrada de vídeo 720P
por segundo
$0.359

Step 3.7 Flash

StepFunInternationalLançado 28 de mai. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo de raciocínio multimodal StepFun com entrada de imagem e vídeo, chamada de ferramenta, esforço de raciocínio ajustável e contexto 256K.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.20
Saída
por tokens gerados 1M
$1.15
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.04
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Step 3.5 Flash

StepFunInternationalLançado 12 de fev. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo de raciocínio textual StepFun para agentes, codificação, chamada de ferramentas e análise de contexto longo.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.10
Saída
por tokens gerados 1M
$0.30
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.02
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Step 3.5 Flash 2603

StepFunInternationalLançado 2 de abr. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Variante Flash Step 3.5 otimizada para agente com modos de esforço de raciocínio baixo e alto.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.10
Saída
por tokens gerados 1M
$0.30
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.02
Busca na Web (Linkup)
por chamada quando invocado
$0.013

StepAudio 2.5 Chat

StepFunInternationalCtx 256KGeração de Texto
Endpoint proprietário

Modelo de conversa de áudio e texto StepFun com saída de texto e compreensão paralinguística.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.43
Saída
por tokens gerados 1M
$3.57
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.29
Busca na Web (Linkup)
por chamada quando invocado
$0.013

Step Image Edit 2

StepFunInternationalLançado 29 de abr. de 2026Geração de Imagens
Endpoint proprietário

Modelo de geração e edição de imagens StepFun para edições text-to-image e de imagem única.

Tipo
Especificação
Tarifa
Imagem de saída
por imagem gerada
$0.003

StepAudio 2.5 TTS

StepFunInternationalLançado 21 de abr. de 2026Geração de Áudio
Endpoint proprietário

Modelo contextual StepFun text-to-speech com direção de voz em linguagem natural e entrega expressiva.

Tipo
Especificação
Tarifa
Síntese
por 10.000 caracteres
$0.85

Step TTS 2

StepFunInternationalGeração de Áudio
Endpoint proprietário

StepFun text-to-speech modelo com vozes oficiais, vozes clonadas personalizadas e controles de tag de voz.

Tipo
Especificação
Tarifa
Síntese
por 10.000 caracteres
$0.40

StepAudio 2.5 ASR

StepFunInternationalLançado 24 de abr. de 2026Transcrição
Endpoint proprietário

Modelo de reconhecimento de fala em streaming StepFun para transcrição de áudio em chinês e inglês.

Tipo
Especificação
Tarifa
Transcrição
por hora de áudio
$0.022

Seed 2.1 Turbo

ByteDanceMalaysiaLançado 13 de jul. de 2026Ctx 256KGeração de Texto
Endpoint proprietário

Modelo de codificação e agente de próxima geração com entrega de código de nível de engenharia, autonomia de longo prazo e compreensão multimodal de 256K.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.63
Saída
por tokens gerados 1M
$3.13

Qwen Audio 3.0 TTS

Alibaba CloudSingaporeLançado 20 de jul. de 2026Geração de Áudio
Endpoint proprietário

Síntese de fala em níveis com mais de 1.000 vozes, 16 idiomas, 20 dialetos chineses, direção de entrega em linguagem natural e tags emocionais inline.

Tipo
Especificação
Tarifa
Síntese Plus
por 10.000 caracteres
$0.20
Síntese em flash
por 10.000 caracteres
$0.15

MiniMax H3

MiniMaxSingaporeLançado 31 de jul. de 2026Geração de Vídeo
Endpoint proprietário

Gera clipes de 4 a 15 segundos em até 2K com áudio estéreo nativo, seguindo referências de texto, imagem, vídeo e áudio em uma única solicitação.

Tipo
Especificação
Tarifa
768p
por segundo
$0.18
2K
por segundo
$0.26
Regeneração 2K
por segundo
$0.10
Entrada de imagem de referência
por imagem de entrada após as primeiras 5
$0.08
Entrada de expansão rápida
por fichas de alerta de 1M
$1.80
Saída de expansão por prompt
por tokens gerados 1M
$7.20

GPT Image 2

OpenAILançado 21 de abr. de 2026Geração de Imagens
Endpoint proprietário

Modelo de imagem principal da OpenAI com forte fidelidade de prompts, renderização de texto nítida e edição baseada em instruções em até 16 imagens de referência.

Tipo
Especificação
Tarifa
Baixo
por imagem
$0.012
Médio
por imagem
$0.106
Alto
por imagem
$0.422

Kling V3

Kling AILançado 5 de fev. de 2026Geração de Vídeo
Endpoint proprietário

Gerador de vídeo Kling 3.0 da Kuaishou com text-to-video, primeiro e último quadro image-to-video, áudio nativo e saída 720p, 1080p ou 4K.

Tipo
Especificação
Tarifa
Padrão T2V/I2V
por segundo
$0.168
Padrão T2V/I2V Som
por segundo
$0.252
Pro T2V/I2V
por segundo
$0.224
Pro T2V/I2V Som
por segundo
$0.336
4K T2V/I2V
por segundo
$0.84

Wan 2.5

Alibaba CloudSingaporeLançado 24 de set. de 2025Geração de Vídeo
Endpoint proprietário

Modelo de vídeo Wan 2.5 da Alibaba com text-to-video e image-to-video, áudio nativo, faixas de áudio personalizadas opcionais e saída de 480p a 1080p.

Tipo
Especificação
Tarifa
480P
por segundo
$0.05
720P
por segundo
$0.10
1080P
por segundo
$0.15

Wan 2.2

Alibaba CloudSingaporeLançado 28 de jul. de 2025Geração de Vídeo
Endpoint proprietário

Família de vídeo Wan 2.2 da Alibaba com níveis padrão e flash, interpolação de primeiro e último quadro, e saída de 480p para 1080p a baixo custo.

Tipo
Especificação
Tarifa
480P padrão
por segundo
$0.02
Padrão 1080P
por segundo
$0.10
Flash 480P
por segundo
$0.015
Flash 720P
por segundo
$0.036
Flash 1080P
por segundo
$0.07

Wan 2.1

Alibaba CloudSingaporeLançado 25 de fev. de 2025Geração de Vídeo
Endpoint proprietário

Modelo de vídeo Wan 2.1 da Alibaba com níveis turbo e plus para text-to-video, image-to-video e primeiro e último quadro clipam em 480p ou 720p.

Tipo
Especificação
Tarifa
Turbo
por segundo
$0.036
Além disso
por segundo
$0.10

Wan2.5 Image

Alibaba CloudSingaporeLançado 24 de set. de 2025Geração de Imagens
Endpoint proprietário

Modelo de imagem Wan 2.5 da Alibaba com edição text-to-image e multirreferência de até 3 imagens em cerca de 1,7 megapixels.

Tipo
Especificação
Tarifa
Padrão
por imagem
$0.030

Wan2.2 Image

Alibaba CloudSingaporeLançado 28 de jul. de 2025Geração de Imagens
Endpoint proprietário

O modelo Wan 2.2 da Alibaba text-to-image com níveis plus e flash e até 1440x1440 de saída a baixo preço por imagem.

Tipo
Especificação
Tarifa
Além disso
por imagem
$0.05
Flash
por imagem
$0.025

Wan2.1 Image

Alibaba CloudSingaporeLançado 25 de fev. de 2025Geração de Imagens
Endpoint proprietário

Modelo Wan 2.1 text-to-image da Alibaba com níveis turbo e plus e até 1440x1440 com preço baixo por imagem.

Tipo
Especificação
Tarifa
Turbo
por imagem
$0.025
Além disso
por imagem
$0.05

Seedance 2.5

ByteDanceMalaysiaLançado 7 de ago. de 2026Geração de Vídeo
Endpoint proprietário

Modelo de vídeo de formato longo para clipes coerentes de até 30 segundos, com até 50 imagens de referência, vídeos e clipes de áudio, áudio nativo, edição e extensão.

Tipo
Especificação
Tarifa
T2V/I2V 480P
por segundo
$0.206
T2V/I2V 720P
por segundo
$0.462
Entrada de vídeo 480P
por segundo de entrada mais saída
$0.123
Entrada de vídeo 720P
por segundo de entrada mais saída
$0.276

140 / 155 Modelos

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.

Métrica

Especificação

Preço (por 1M de Tokens)

Nenhum item encontrado.