Découvrez notre production prête Modèles d’IA

Parcourez le catalogue complet des modèles: texte, image, audio, vidéo, 3D et plus encore.

Catalogue de modèles

Des modèles d’IA sur une API compatible OpenAI.

Parcourez les points de terminaison texte, image, vidéo, audio, 3D, recherche et agents avec pay-as-you-go prix. Le catalogue interactif charge la disponibilité actuelle d’EmpirioLabs, et ces documents modèles sont accessibles sans JavaScript client.

Documents du modèle ouvert

New & Featured

Save up to 47%
Inférence nativeNouveau

Modèle agent 30B ouvert Meta avec compréhension de l’image, contexte 128K, appel d’outils, sortie structurée et force de raisonnement contrôlable.

Publié 10 août 2026128K contexte

Seedance 2.5

ByteDance
Endpoint propriétaireNouveau

Modèle vidéo long pour des clips cohérents jusqu’à 30 secondes, avec jusqu’à 50 images de référence, vidéos et extraits audio, audio natif, montage et extension.

MalaysiaPublié 7 août 2026
Endpoint propriétaireNouveau

Le modèle de raisonnement de frontière mis à jour de Meta avec un contexte de 1 048 576 jetons, une compréhension de l’image, de la vidéo, de l’audio et du PDF, une recherche web et un appel d’outils.

Publié 5 août 20261M contexte

Qwen Image 3.0

Alibaba Cloud
Endpoint propriétaireNouveau

Génération et édition d’images Qwen avec variantes Base et Pro, typographie multilingue, références multi-images, et sortie contrôlable en 1K ou 2K.

SingaporePublié 21 juil. 2026

MiniMax H3

MiniMax
Endpoint propriétaireNouveau

Génère des clips de 4 à 15 secondes jusqu’à 2K avec un audio stéréo natif, suivant des références texte, image, vidéo et audio dans une seule requête.

SingaporePublié 31 juil. 2026
Save up to 18%

Qwen3.8 Max

Alibaba Cloud
Endpoint propriétaireNouveau

Un modèle phare du MoE à l’échelle d’un billion pour le codage, les agents à long horizon et le travail professionnel, avec une compréhension image et vidéo dans un contexte à 1 million de jetons.

SingaporePublié 3 août 20261M contexte
ChinaPublié 3 août 20261M contexte

Génération de texte66

Save up to 21%
Endpoint propriétaireNouveau

Modèle de raisonnement et de codage avec un contexte de jeton 1M, sortie 128K, effort de raisonnement ajustable, recherche web native et appel d’outils.

SingaporePublié 16 juin 20261M contexte
GermanyPublié 16 juin 20261M contexte

Kimi K3

Moonshot AI
Endpoint propriétaireNouveau

Kimi K3 est le modèle phare de raisonnement de Moonshot avec un contexte de jeton 1M, une pensée toujours active, une recherche web native, ainsi que des entrées texte, image et vidéo.

InternationalPublié 15 juil. 20261M contexte
Endpoint propriétaireNouveau

Le modèle de raisonnement de frontière mis à jour de Meta avec un contexte de 1 048 576 jetons, une compréhension de l’image, de la vidéo, de l’audio et du PDF, une recherche web et un appel d’outils.

Publié 5 août 20261M contexte
Save up to 7%

Kimi K2.7 Code

Moonshot AI
Endpoint propriétaire

Le code Kimi K2.7 est le modèle de codage agent à un billion de paramètres de Moonshot avec un contexte 256K, un raisonnement toujours activé, ainsi que des entrées texte, image et vidéo.

InternationalPublié 16 juin 2026256K contexte
GermanyPublié 16 juin 2026256K contexte
Endpoint propriétaireNouveau

Modèle de raisonnement de la meta-frontière avec un contexte de 1 048 576 jetons, plus une compréhension d’images, de vidéos, d’audio et de PDF, de recherche web et d’appel d’outils.

Publié 9 juil. 20261M contexte
Endpoint propriétaireNouveau

Conducteur multi-agent mis à jour pour le raisonnement approfondi, le codage et la recherche, avec un effort maximal distinct, un contexte 1M, une saisie d’images et une recherche web.

Publié 23 juil. 20261M contexte

Génération d’images14

Save up to 39%

FLUX.2 Klein 4B

Black Forest Labs
Inférence native

Modèle de génération et d’édition d’images Klein 4B FLUX.2 sous licence Apache avec text-to-image, retouche d’images de référence et support de flux de travail créatif.

Publié 15 janv. 2026
Endpoint propriétaire

La génération et l’édition d’images modèlent la création et la modification d’images à partir de texte ou d’entrées d’images, avec inpainting, essais virtuels et contrôles de style.

Publié 3 déc. 2024
Endpoint propriétaire

Modèle text-to-image open source sur une architecture multimodale Mixture-of-Experts, avec un niveau de détail photoréaliste et un rendu textuel multilingue puissant.

Publié 28 sept. 2025
Endpoint propriétaire

Cadre autorégressif sur le modèle Janus Pro 7B qui unifie la compréhension multimodale et la génération d’images en une seule architecture.

Publié 27 janv. 2025

Qwen Image 2.0

Alibaba Cloud
Endpoint propriétaire

Modèle unifié de génération et d’édition d’images avec un rendu de texte Chinese/English complexe de premier plan, des textures réalistes et une fusion multi-images.

SingaporePublié 3 mars 2026

Qwen Image 3.0

Alibaba Cloud
Endpoint propriétaireNouveau

Génération et édition d’images Qwen avec variantes Base et Pro, typographie multilingue, références multi-images, et sortie contrôlable en 1K ou 2K.

SingaporePublié 21 juil. 2026

Génération de vidéos23

Endpoint propriétaireNouveau

Texte en vidéo et image-to-video avec audio natif synchronisé, en 720p ou 1080p pendant 3 à 15 secondes, avec contrôle au format et aux invites.

Publié 17 juin 2026
Endpoint propriétaire

Modèle de génération vidéo produisant jusqu’à 2 minutes de vidéos multi-plans à partir de texte et d’images optionnelles, avec une qualité et une cohérence améliorées.

Publié 7 avr. 2025

HappyHorse 1.0

Alibaba Cloud
Endpoint propriétaire

Modèle vidéo proposant des modes Text-to-Video, Image-to-Video, Reference-to-Video et Édition Vidéo avec une sortie haute fidélité et fluide au mouvement.

SingaporePublié 6 mai 2026
Save up to 19%
Inférence native

Modèle vidéo à paramètres 8,3B avec sortie native 720p (upscalable en 1080p), forte cohérence de mouvement et compréhension bilingue des prompts jusqu’à 10 secondes.

Publié 20 nov. 2025

Kling O3

Kling AI
Endpoint propriétaire

Modèle vidéo en modes Standard ou Pro avec Texte en Vidéo, Image-Vidéo, Référence en Vidéo, Montage, son natif et transitions multi-scènes.

Publié 5 févr. 2026
Endpoint propriétaire

Modèle Kling 3.0 qui transfère le mouvement d’une vidéo de référence vers un caractère issu d’une image de référence, avec des patiers Standard 720p et Pro 1080p.

Production audio14

Save up to 17%
Inférence native

Modèle de génération musicale open source pour l’audio guidé par text-to-song et paroles, avec une inférence XL Turbo rapide en 8 étapes pour une itération contrôlable des chansons.

Publié 2 avr. 2026
Save up to 12%

TTS 2

Inworld
Endpoint propriétaireNouveau

Modèle de voix en temps réel avec une direction en anglais simple, une identité vocale unique sur 100+ langues, et time-to-first-audio en streaming sous 200 ms.

Publié 5 mai 2026
Save up to 30%
Endpoint propriétaire

Synthèse vocale TTFB en moins de 130 ms avec 271+ voix réparties dans 15 langues, prosodie expressive et streaming SSE en temps réel pour agents vocaux à faible latence.

Publié 21 janv. 2026
Save up to 15%
Endpoint propriétaire

Synthèse vocale de qualité broadcast avec prosodie expressive riche, 271+ voix dans 15 langues, et streaming SSE en temps réel avec horodatages par mot.

Publié 21 janv. 2026
Endpoint propriétaire

Faible latence text-to-speech avec voix à un ou plusieurs haut-parleurs, ainsi qu’un style, un accent et un ton expressif contrôlables pour les applications de production.

Publié 20 mai 2025
Endpoint propriétaire

Aperçu TTS de haute qualité pour podcasts, livres audio et support client, avec des voix expressives multi-haut-parleurs dans 23+ langues.

Publié 20 mai 2025

Transcription4

Endpoint propriétaire

La transcription vocale en texte utilisant le modèle Nova-3 avec prise en charge multilingue et réglages avancés personnalisables pour les charges de production.

Publié 12 févr. 2025
Endpoint propriétaire

Whisper-1 speech-to-text transcription entraînée sur un audio supervisé multilingue, avec une limite de téléversement de 25 Mo par fichier.

Publié 21 sept. 2022
Save up to 17%
Inférence native

Transcription contrôlée Whisper Large v3 Turbo avec ASR multilingue, traduction, VAD, horodatages, sous-titres, hotwords et contrôles décodeurs.

Publié 1 oct. 2024
Endpoint propriétaireNouveau

Modèle de reconnaissance vocale en streaming StepFun pour la transcription audio chinoise et anglaise.

InternationalPublié 24 avr. 2026

Recherche et recherche13

Endpoint propriétaire

Réponse rapide de type LLM à une question en langage naturel, fondée sur de nouveaux résultats de recherche exa web avec des citations en ligne et des liens sources.

Endpoint propriétaire

Recherche web propulsée par l’IA avec des aperçus détaillés et des réponses, plus rapide que la recherche profonde. Il se classe #1 sur le benchmark OpenAI SimpleQA.

100K contexte
Endpoint propriétaire

Recherche de niveau institutionnel propulsée par le raisonnement Claude Opus 4.6, avec une profondeur maximale, un accès amélioré aux outils et une couverture source étendue.

Endpoint propriétaire

Modèle de recherche pour la récupération, la synthèse et le raisonnement en plusieurs étapes, en recherchant, lisant et évaluant de manière autonome les sources sur des sujets complexes.

128K contexte

Génération 3D1

Save up to 90%

TRELLIS.2 4B

Microsoft
Inférence native

TRELLIS.2 modèle image-de-3D qui transforme une image de référence en un asset GLB texturé avec des contrôles de résolution, de graine, de maillage, de texture et d’exportation.

Encastrements3

Text Embedding v4

Alibaba Cloud
Endpoint propriétaire

Intégration de texte multilingue avec dimensions de sortie sélectionnables (64–2048). Jusqu’à 8 192 jetons par entrée.

SingaporePublié 4 juin 20258K contexte
Endpoint propriétaire

Speed-optimised multimodal embedding, same shape as Vision-Plus, 3× cheaper image/video tokens.

SingaporePublié 23 sept. 20251K contexte
Endpoint propriétaire

L’intégration multimodale produisant des vecteurs indépendants pour le texte, l’image et les entrées vidéo.

SingaporePublié 23 sept. 20251K contexte

Remonteurs1

Qwen3 Rerank

Alibaba Cloud
Endpoint propriétaire

Reclasseur sémantique de documents. Trie jusqu’à 500 candidats par requête selon leur pertinence, prend en charge 100+ langages et accepte une instruction de tri personnalisée.

SingaporePublié 5 juin 20254K contexte

Outils & Agents2

GPTZero

GPTZero
Endpoint propriétaire

Détecteur d’apprentissage profond qui signale les parties de texte probablement générées par l’IA par rapport à l’humain, classant le contenu comme entièrement humain, IA ou mixte.

Manus

Manus
Endpoint propriétaire

Agent IA autonome qui transforme une invite de haut niveau en sous-tâches, appelle des outils et des API, et délivre end-to-end résultats sans orchestration manuelle.

Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.
Aucun objet trouvé.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.