Découvrez notre production prête Modèles d’IA

Parcourez le catalogue complet des modèles: texte, image, audio, vidéo, 3D et plus encore.

Catalogue de modèles

Des modèles d’IA sur une API compatible OpenAI.

Parcourez les points de terminaison texte, image, vidéo, audio, 3D, recherche et agents avec pay-as-you-go prix. Le catalogue interactif charge la disponibilité actuelle d’EmpirioLabs, et ces documents modèles sont accessibles sans JavaScript client.

Documents du modèle ouvert

New & Featured

Endpoint propriétaireNouveau

Coding and agentic model with a 1M token context, 128K output, always-on reasoning at low, high, or max effort, native web search, and tool calling.

SingaporePublié 14 août 20261M contexte
Save up to 84%

Qwen3.8 27B

Alibaba Cloud
Inférence nativeNouveau

Multimodal reasoner with 256K context, image and video input, function tools, structured JSON, and thinking on by default.

Publié 14 août 2026256K contexte
Save up to 10%
Inférence nativeNouveau

Generates complete stereo songs from lyrics and a style prompt, with duration, seed, and format controls up to 5 minutes.

Publié 13 août 2026
Endpoint propriétaireNouveau

Official 0813 Pro release with major gains across coding, repository work, tool use, and agent tasks, plus hybrid thinking and a 1M context window.

SingaporePublié 13 août 20261M contexte
Endpoint propriétaireNouveau

Text-to-image plus multi-reference editing with up to three source images, selectable quality tiers, and 1K or 2K output resolution.

Publié 7 août 2026
Save up to 47%
Inférence nativeNouveau

Modèle agent 30B ouvert Meta avec compréhension de l’image, contexte 128K, appel d’outils, sortie structurée et force de raisonnement contrôlable.

Publié 10 août 2026128K contexte

Génération de texte69

Endpoint propriétaireNouveau

Coding and agentic model with a 1M token context, 128K output, always-on reasoning at low, high, or max effort, native web search, and tool calling.

SingaporePublié 14 août 20261M contexte
Save up to 21%
Endpoint propriétaire

Modèle de raisonnement et de codage avec un contexte de jeton 1M, sortie 128K, effort de raisonnement ajustable, recherche web native et appel d’outils.

SingaporePublié 16 juin 20261M contexte
GermanyPublié 16 juin 20261M contexte
United StatesPublié 16 juin 20261M contexte

Kimi K3

Moonshot AI
Endpoint propriétaireNouveau

Kimi K3 est le modèle phare de raisonnement de Moonshot avec un contexte de jeton 1M, une pensée toujours active, une recherche web native, ainsi que des entrées texte, image et vidéo.

InternationalPublié 15 juil. 20261M contexte
Endpoint propriétaireNouveau

Le modèle de raisonnement de frontière mis à jour de Meta avec un contexte de 1 048 576 jetons, une compréhension de l’image, de la vidéo, de l’audio et du PDF, une recherche web et un appel d’outils.

Publié 5 août 20261M contexte
Save up to 7%

Kimi K2.7 Code

Moonshot AI
Endpoint propriétaire

Le code Kimi K2.7 est le modèle de codage agent à un billion de paramètres de Moonshot avec un contexte 256K, un raisonnement toujours activé, ainsi que des entrées texte, image et vidéo.

InternationalPublié 16 juin 2026256K contexte
GermanyPublié 16 juin 2026256K contexte
Endpoint propriétaireNouveau

Modèle de raisonnement de la meta-frontière avec un contexte de 1 048 576 jetons, plus une compréhension d’images, de vidéos, d’audio et de PDF, de recherche web et d’appel d’outils.

Publié 9 juil. 20261M contexte

Génération d’images17

Save up to 39%

FLUX.2 Klein 4B

Black Forest Labs
Inférence native

Modèle de génération et d’édition d’images Klein 4B FLUX.2 sous licence Apache avec text-to-image, retouche d’images de référence et support de flux de travail créatif.

Publié 15 janv. 2026
Endpoint propriétaire

La génération et l’édition d’images modèlent la création et la modification d’images à partir de texte ou d’entrées d’images, avec inpainting, essais virtuels et contrôles de style.

Publié 3 déc. 2024
Endpoint propriétaire

Modèle text-to-image open source sur une architecture multimodale Mixture-of-Experts, avec un niveau de détail photoréaliste et un rendu textuel multilingue puissant.

Publié 28 sept. 2025
Endpoint propriétaire

Cadre autorégressif sur le modèle Janus Pro 7B qui unifie la compréhension multimodale et la génération d’images en une seule architecture.

Publié 27 janv. 2025

Qwen Image 2.0

Alibaba Cloud
Endpoint propriétaire

Modèle unifié de génération et d’édition d’images avec un rendu de texte Chinese/English complexe de premier plan, des textures réalistes et une fusion multi-images.

SingaporePublié 3 mars 2026

Qwen Image 3.0

Alibaba Cloud
Endpoint propriétaireNouveau

Génération et édition d’images Qwen avec variantes Base et Pro, typographie multilingue, références multi-images, et sortie contrôlable en 1K ou 2K.

SingaporePublié 21 juil. 2026

Génération de vidéos29

Endpoint propriétaire

Texte en vidéo et image-to-video avec audio natif synchronisé, en 720p ou 1080p pendant 3 à 15 secondes, avec contrôle au format et aux invites.

Publié 17 juin 2026
Endpoint propriétaire

Modèle de génération vidéo produisant jusqu’à 2 minutes de vidéos multi-plans à partir de texte et d’images optionnelles, avec une qualité et une cohérence améliorées.

Publié 7 avr. 2025

HappyHorse 1.0

Alibaba Cloud
Endpoint propriétaire

Modèle vidéo proposant des modes Text-to-Video, Image-to-Video, Reference-to-Video et Édition Vidéo avec une sortie haute fidélité et fluide au mouvement.

SingaporePublié 6 mai 2026
Save up to 19%
Inférence native

Modèle vidéo à paramètres 8,3B avec sortie native 720p (upscalable en 1080p), forte cohérence de mouvement et compréhension bilingue des prompts jusqu’à 10 secondes.

Publié 20 nov. 2025

Kling O3

Kling AI
Endpoint propriétaire

Modèle vidéo en modes Standard ou Pro avec Texte en Vidéo, Image-Vidéo, Référence en Vidéo, Montage, son natif et transitions multi-scènes.

Publié 5 févr. 2026
Endpoint propriétaire

Modèle Kling 3.0 qui transfère le mouvement d’une vidéo de référence vers un caractère issu d’une image de référence, avec des patiers Standard 720p et Pro 1080p.

Production audio15

Save up to 17%
Inférence native

Modèle de génération musicale open source pour l’audio guidé par text-to-song et paroles, avec une inférence XL Turbo rapide en 8 étapes pour une itération contrôlable des chansons.

Publié 2 avr. 2026
Save up to 12%

TTS 2

Inworld
Endpoint propriétaireNouveau

Modèle de voix en temps réel avec une direction en anglais simple, une identité vocale unique sur 100+ langues, et time-to-first-audio en streaming sous 200 ms.

Publié 5 mai 2026
Save up to 30%
Endpoint propriétaire

Synthèse vocale TTFB en moins de 130 ms avec 271+ voix réparties dans 15 langues, prosodie expressive et streaming SSE en temps réel pour agents vocaux à faible latence.

Publié 21 janv. 2026
Save up to 15%
Endpoint propriétaire

Synthèse vocale de qualité broadcast avec prosodie expressive riche, 271+ voix dans 15 langues, et streaming SSE en temps réel avec horodatages par mot.

Publié 21 janv. 2026
Save up to 10%
Inférence nativeNouveau

Generates complete stereo songs from lyrics and a style prompt, with duration, seed, and format controls up to 5 minutes.

Publié 13 août 2026
Endpoint propriétaire

Faible latence text-to-speech avec voix à un ou plusieurs haut-parleurs, ainsi qu’un style, un accent et un ton expressif contrôlables pour les applications de production.

Publié 20 mai 2025

Transcription4

Endpoint propriétaire

La transcription vocale en texte utilisant le modèle Nova-3 avec prise en charge multilingue et réglages avancés personnalisables pour les charges de production.

Publié 12 févr. 2025
Endpoint propriétaire

Whisper-1 speech-to-text transcription entraînée sur un audio supervisé multilingue, avec une limite de téléversement de 25 Mo par fichier.

Publié 21 sept. 2022
Save up to 17%
Inférence native

Transcription contrôlée Whisper Large v3 Turbo avec ASR multilingue, traduction, VAD, horodatages, sous-titres, hotwords et contrôles décodeurs.

Publié 1 oct. 2024
Endpoint propriétaireNouveau

Modèle de reconnaissance vocale en streaming StepFun pour la transcription audio chinoise et anglaise.

InternationalPublié 24 avr. 2026

Recherche et recherche13

Endpoint propriétaire

Réponse rapide de type LLM à une question en langage naturel, fondée sur de nouveaux résultats de recherche exa web avec des citations en ligne et des liens sources.

Endpoint propriétaire

Recherche web propulsée par l’IA avec des aperçus détaillés et des réponses, plus rapide que la recherche profonde. Il se classe #1 sur le benchmark OpenAI SimpleQA.

100K contexte
Endpoint propriétaire

Recherche de niveau institutionnel propulsée par le raisonnement Claude Opus 4.6, avec une profondeur maximale, un accès amélioré aux outils et une couverture source étendue.

Endpoint propriétaire

Modèle de recherche pour la récupération, la synthèse et le raisonnement en plusieurs étapes, en recherchant, lisant et évaluant de manière autonome les sources sur des sujets complexes.

128K contexte

Génération 3D3

Save up to 90%

TRELLIS.2 4B

Microsoft
Inférence native

TRELLIS.2 modèle image-de-3D qui transforme une image de référence en un asset GLB texturé avec des contrôles de résolution, de graine, de maillage, de texture et d’exportation.

Endpoint propriétaire

Rodin Gen-2 engine that turns a text prompt or up to five reference images into production 3D assets with PBR materials and quad or raw meshes.

MalaysiaPublié 1 oct. 2025
Endpoint propriétaire

Production-focused image-to-3D with structure-aware textures, 1536 and 1536 Pro precision tiers, meshes up to two million faces, and five export formats.

Malaysia

Encastrements4

Text Embedding v4

Alibaba Cloud
Endpoint propriétaire

Intégration de texte multilingue avec dimensions de sortie sélectionnables (64–2048). Jusqu’à 8 192 jetons par entrée.

SingaporePublié 4 juin 20258K contexte
Endpoint propriétaire

Speed-optimised multimodal embedding, same shape as Vision-Plus, 3× cheaper image/video tokens.

SingaporePublié 23 sept. 20251K contexte
Endpoint propriétaire

L’intégration multimodale produisant des vecteurs indépendants pour le texte, l’image et les entrées vidéo.

SingaporePublié 23 sept. 20251K contexte
Endpoint propriétaire

Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.

MalaysiaPublié 28 juin 20258K contexte

Remonteurs1

Qwen3 Rerank

Alibaba Cloud
Endpoint propriétaire

Reclasseur sémantique de documents. Trie jusqu’à 500 candidats par requête selon leur pertinence, prend en charge 100+ langages et accepte une instruction de tri personnalisée.

SingaporePublié 5 juin 20254K contexte

Outils & Agents2

GPTZero

GPTZero
Endpoint propriétaire

Détecteur d’apprentissage profond qui signale les parties de texte probablement générées par l’IA par rapport à l’humain, classant le contenu comme entièrement humain, IA ou mixte.

Manus

Manus
Endpoint propriétaire

Agent IA autonome qui transforme une invite de haut niveau en sous-tâches, appelle des outils et des API, et délivre end-to-end résultats sans orchestration manuelle.

Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.