Explore nossa produção pronta Modelos de IA

Navegue pelo catálogo completo de modelos em texto, imagem, áudio, vídeo, 3D e muito mais.

Catálogo de modelos

Modelos de IA em uma API compatível com OpenAI.

Navegue por texto, imagem, vídeo, áudio, 3D, busca e endpoints de agentes com preços pay-as-you-go. O catálogo interativo carrega a disponibilidade atual do EmpirioLabs, e esses documentos modelo são rastreáveis sem JavaScript do cliente.

Documentação do modelo aberto

New & Featured

Endpoint proprietárioNovo

Coding and agentic model with a 1M token context, 128K output, always-on reasoning at low, high, or max effort, native web search, and tool calling.

SingaporeLançado 14 de ago. de 20261M contexto
Save up to 84%

Qwen3.8 27B

Alibaba Cloud
Inferência nativaNovo

Multimodal reasoner with 256K context, image and video input, function tools, structured JSON, and thinking on by default.

Lançado 14 de ago. de 2026256K contexto
Save up to 10%
Inferência nativaNovo

Generates complete stereo songs from lyrics and a style prompt, with duration, seed, and format controls up to 5 minutes.

Lançado 13 de ago. de 2026
Endpoint proprietárioNovo

Official 0813 Pro release with major gains across coding, repository work, tool use, and agent tasks, plus hybrid thinking and a 1M context window.

SingaporeLançado 13 de ago. de 20261M contexto
Endpoint proprietárioNovo

Text-to-image plus multi-reference editing with up to three source images, selectable quality tiers, and 1K or 2K output resolution.

Lançado 7 de ago. de 2026
Save up to 47%
Inferência nativaNovo

Meta Open modelo agentical 30B com compreensão de imagem, contexto 128K, chamada de ferramenta, saída estruturada e força de raciocínio controlável.

Lançado 10 de ago. de 2026128K contexto

Geração de Texto69

Endpoint proprietárioNovo

Coding and agentic model with a 1M token context, 128K output, always-on reasoning at low, high, or max effort, native web search, and tool calling.

SingaporeLançado 14 de ago. de 20261M contexto
Save up to 21%
Endpoint proprietário

Modelo de raciocínio e codificação com um contexto de token de 1M, saída de 128K, esforço de raciocínio ajustável, busca nativa na web e chamada de ferramentas.

SingaporeLançado 16 de jun. de 20261M contexto
GermanyLançado 16 de jun. de 20261M contexto
United StatesLançado 16 de jun. de 20261M contexto

Kimi K3

Moonshot AI
Endpoint proprietárioNovo

Kimi K3 é o modelo principal de raciocínio da Moonshot, com contexto de token 1M, pensamento sempre ativo, busca nativa na web e entradas de texto, imagem e vídeo.

InternationalLançado 15 de jul. de 20261M contexto
Endpoint proprietárioNovo

O modelo atualizado de raciocínio fronteiriço da Meta com um contexto de 1.048.576 tokens, entendimento de imagem, vídeo, áudio e PDF, busca na web e uso de ferramentas.

Lançado 5 de ago. de 20261M contexto
Save up to 7%

Kimi K2.7 Code

Moonshot AI
Endpoint proprietário

Kimi K2.7 Code é o modelo de codificação agente de trilhões de parâmetros da Moonshot, com contexto de 256K, raciocínio sempre ativo e entradas de texto, imagem e vídeo.

InternationalLançado 16 de jun. de 2026256K contexto
GermanyLançado 16 de jun. de 2026256K contexto
Endpoint proprietárioNovo

Modelo de raciocínio metafrontier com um contexto de 1.048.576 tokens, além de entendimento de imagens, vídeos, áudio e PDF, busca na web e uso de ferramentas.

Lançado 9 de jul. de 20261M contexto

Geração de Imagem17

Save up to 39%

FLUX.2 Klein 4B

Black Forest Labs
Inferência nativa

Modelo de geração e edição de imagens 4B FLUX.2 Klein licenciado por Apache com suporte a text-to-image, edição de imagens de referência e workflow criativo.

Lançado 15 de jan. de 2026
Endpoint proprietário

Geração e edição de imagens modelam a criação e modificação de imagens a partir de texto ou entradas de imagem, com inpainting, virtual try-on e controles de estilo.

Lançado 3 de dez. de 2024
Endpoint proprietário

Modelo text-to-image de código aberto em uma arquitetura multimodal Mixture-of-Experts, com detalhes fotorrealistas e forte renderização multilíngue de texto.

Lançado 28 de set. de 2025
Endpoint proprietário

Framework autorregressivo no modelo Janus Pro 7B que unifica compreensão multimodal e geração de imagens em uma única arquitetura.

Lançado 27 de jan. de 2025

Qwen Image 2.0

Alibaba Cloud
Endpoint proprietário

Modelo unificado de geração e edição de imagens com renderização de texto complexa Chinese/English líder de classe, texturas realistas e fusão multi-imagem.

SingaporeLançado 3 de mar. de 2026

Qwen Image 3.0

Alibaba Cloud
Endpoint proprietárioNovo

Geração e edição de imagens Qwen com variantes Base e Pro, tipografia multilíngue, referências multi-imagem e saída controlável em 1K ou 2K.

SingaporeLançado 21 de jul. de 2026

Geração de Vídeo29

Endpoint proprietário

Texto para vídeo e image-to-video com áudio nativo sincronizado, em 720p ou 1080p por 3 a 15 segundos, com proporção de aspecto e controle de prompt.

Lançado 17 de jun. de 2026
Endpoint proprietário

Modelo de geração de vídeo produzindo vídeos de até 2 minutos com múltiplas tomadas a partir de texto e prompts opcionais de imagem, com qualidade e consistência aprimoradas.

Lançado 7 de abr. de 2025

HappyHorse 1.0

Alibaba Cloud
Endpoint proprietário

Modelo de vídeo oferecendo modos Texto-para-Vídeo, Imagem-para-Vídeo, Referência para Vídeo e Edição de Vídeo com saída de alta fidelidade e fluidez de movimento.

SingaporeLançado 6 de mai. de 2026
Save up to 19%
Inferência nativa

Modelo de vídeo com 8.3B e saída nativa 720p (upscalável para 1080p), forte coerência de movimento e compreensão bilíngue de prompts de até 10s.

Lançado 20 de nov. de 2025

Kling O3

Kling AI
Endpoint proprietário

Modelo de vídeo nos modos Standard ou Pro com Texto para Vídeo, Imagem para Vídeo, Referência para Vídeo, edição, som nativo e transições multi-cena.

Lançado 5 de fev. de 2026
Endpoint proprietário

Modelo Kling 3.0 que transfere movimento de um vídeo de referência para um personagem de uma imagem de referência, com camadas padrão 720p e Pro 1080p.

Geração de Áudio15

Save up to 17%
Inferência nativa

Modelo de geração de música open-source para áudio guiado por text-to-song e letras, com inferência XL Turbo rápida de 8 passos para iteração controlável das músicas.

Lançado 2 de abr. de 2026
Save up to 12%

TTS 2

Inworld
Endpoint proprietárioNovo

Modelo de voz em tempo real com direção de voz em inglês simples, uma identidade de voz em 100+ idiomas e time-to-first-audio de streaming abaixo de 200ms.

Lançado 5 de mai. de 2026
Save up to 30%
Endpoint proprietário

Síntese de voz TTFB abaixo de 130ms com 271+ vozes em 15 idiomas, prosódia expressiva e streaming SSE em tempo real para agentes de voz de baixa latência.

Lançado 21 de jan. de 2026
Save up to 15%
Endpoint proprietário

Síntese de voz de qualidade de transmissão com prosódia expressiva rica, 271+ vozes em 15 idiomas e streaming SSE em tempo real com carimbos de data por palavra.

Lançado 21 de jan. de 2026
Save up to 10%
Inferência nativaNovo

Generates complete stereo songs from lyrics and a style prompt, with duration, seed, and format controls up to 5 minutes.

Lançado 13 de ago. de 2026
Endpoint proprietário

Baixa latência text-to-speech com vozes de um ou múltiplos alto-falantes e estilo, sotaque e tom expressivo controláveis para aplicativos de produção.

Lançado 20 de mai. de 2025

Transcrição4

Endpoint proprietário

Transcrição de fala para texto usando o modelo Nova-3 com suporte multilíngue e configurações avançadas personalizáveis para cargas de trabalho de produção.

Lançado 12 de fev. de 2025
Endpoint proprietário

Whisper-1 speech-to-text transcrição treinada com áudio supervisionado multilíngue, com limite de upload de 25 MB por arquivo.

Lançado 21 de set. de 2022
Save up to 17%
Inferência nativa

Transcrição controlada Whisper Large v3 Turbo com ASR multilíngue, tradução, VAD, carimbos de tempo, legendas, hotwords e controles de decodificador.

Lançado 1 de out. de 2024
Endpoint proprietárioNovo

Modelo de reconhecimento de fala em streaming StepFun para transcrição de áudio em chinês e inglês.

InternationalLançado 24 de abr. de 2026

Pesquisa e Busca13

Endpoint proprietário

Resposta rápida no estilo LLM para uma pergunta em linguagem natural, baseada em resultados de busca exa frescos com citações e links de fonte.

Endpoint proprietário

Busca na web impulsionada por IA, com visões detalhadas e respostas, mais rápida que a Deep Search. Está em #1 no benchmark OpenAI SimpleQA.

100K contexto
Endpoint proprietário

Pesquisa de nível institucional baseada no raciocínio Claude Opus 4.6, com máxima profundidade, acesso aprimorado às ferramentas e ampla cobertura de fontes.

Endpoint proprietário

Modelo de pesquisa para recuperação, síntese e raciocínio em múltiplas etapas, pesquisando, lendo e avaliando fontes de forma autônoma em tópicos complexos.

128K contexto

Geração 3D3

Save up to 90%

TRELLIS.2 4B

Microsoft
Inferência nativa

TRELLIS.2 modelo imagem-para-3D que transforma uma imagem de referência em um asset GLB texturizado com controles de resolução, semente, malha, textura e exportação.

Endpoint proprietário

Rodin Gen-2 engine that turns a text prompt or up to five reference images into production 3D assets with PBR materials and quad or raw meshes.

MalaysiaLançado 1 de out. de 2025
Endpoint proprietário

Production-focused image-to-3D with structure-aware textures, 1536 and 1536 Pro precision tiers, meshes up to two million faces, and five export formats.

Malaysia

Incorporações4

Text Embedding v4

Alibaba Cloud
Endpoint proprietário

Incorporação de texto multilíngue com dimensões de saída selecionáveis (64–2048). Até 8.192 tokens por entrada.

SingaporeLançado 4 de jun. de 20258K contexto
Endpoint proprietário

Speed-optimised multimodal embedding, same shape as Vision-Plus, 3× cheaper image/video tokens.

SingaporeLançado 23 de set. de 20251K contexto
Endpoint proprietário

Incorporação multimodal produzindo vetores independentes para entradas, texto, imagem e vídeo.

SingaporeLançado 23 de set. de 20251K contexto
Endpoint proprietário

Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.

MalaysiaLançado 28 de jun. de 20258K contexto

Reclassificadores1

Qwen3 Rerank

Alibaba Cloud
Endpoint proprietário

Reclassificador semântico de documentos. Ordena até 500 candidatos por consulta por relevância, suporta 100+ idiomas e aceita uma instrução de ordenação personalizada.

SingaporeLançado 5 de jun. de 20254K contexto

Ferramentas e Agentes2

GPTZero

GPTZero
Endpoint proprietário

Detector de deep learning que sinaliza partes do texto provavelmente geradas por IA versus humanas, classificando o conteúdo como totalmente humano, IA ou misto.

Manus

Manus
Endpoint proprietário

Agente autônomo de IA que transforma um prompt de alto nível em subtarefas, chama ferramentas e APIs, e entrega resultados end-to-end sem orquestração manual.

Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.
Nenhum item encontrado.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.