Entdecken Sie unsere Produktion bereit KI-Modelle

Durchstöbern Sie den vollständigen Katalog der Modelle in Text, Bild, Audio, Video, 3D und mehr.

Modellkatalog

KI modelliert auf einer OpenAI-kompatiblen API.

Durchsuchen Sie Text-, Bild-, Video-, Audio-, 3D-, Such- und Agenten-Endpunkte mit pay-as-you-go Preisen. Der interaktive Katalog lädt die aktuelle Verfügbarkeit von EmpirioLabs, und diese Modelldokumentationen sind ohne Client-JavaScript crawlbar.

Open-Model-Dokumente

New & Featured

Save up to 47%
Native InferenzNeu

Meta-offenes 30B-Agentenmodell mit Bildverständnis, 128K-Kontext, Werkzeugaufrufen, strukturierter Ausgabe und kontrollierbarer Argumentationsstärke.

Veröffentlicht 10. Aug. 2026128K Kontext

Seedance 2.5

ByteDance
Proprietärer EndpointNeu

Langformiges Videomodell für kohärente Clips bis zu 30 Sekunden, mit bis zu 50 Referenzbildern, Videos und Audioclips, nativem Audio, Schnitt und Erweiterung.

MalaysiaVeröffentlicht 7. Aug. 2026
Proprietärer EndpointNeu

Metas aktualisiertes Frontier-Reasoning-Modell mit einem Kontext von 1.048.576 Tokens, Bild-, Video-, Audio- und PDF-Verständnis, Websuche und Werkzeugaufrufen.

Veröffentlicht 5. Aug. 20261M Kontext

Qwen Image 3.0

Alibaba Cloud
Proprietärer EndpointNeu

Qwen-Bildgenerierung und -bearbeitung mit Base- und Pro-Varianten, mehrsprachiger Typografie, mehrfachen Bildreferenzen und steuerbarer 1K- oder 2K-Ausgabe.

SingaporeVeröffentlicht 21. Juli 2026

MiniMax H3

MiniMax
Proprietärer EndpointNeu

Erzeugt 4- bis 15-sekündige Clips mit bis zu 2K und nativem Stereo-Audio und folgt Text-, Bild-, Video- und Audioreferenzen in einer Anfrage.

SingaporeVeröffentlicht 31. Juli 2026
Save up to 18%

Qwen3.8 Max

Alibaba Cloud
Proprietärer EndpointNeu

MoE-Flaggschiff im Billionenmaßstab für Programmierung, langfristige Agenten und professionelle Arbeit, mit Bild- und Videoverständnis über einen 1M-Token-Kontext.

SingaporeVeröffentlicht 3. Aug. 20261M Kontext
ChinaVeröffentlicht 3. Aug. 20261M Kontext

Textgenerierung66

Save up to 21%
Proprietärer EndpointNeu

Logik- und Codierungsmodell mit einem 1M Token-Kontext, 128K-Ausgabe, anpassbarem Schlussfolgerungsaufwand, nativer Websuche und Werkzeugaufrufen.

SingaporeVeröffentlicht 16. Juni 20261M Kontext
GermanyVeröffentlicht 16. Juni 20261M Kontext

Kimi K3

Moonshot AI
Proprietärer EndpointNeu

Kimi K3 ist Moonshots Flaggschiff-Logikmodell mit einem 1-Millionen-Token-Kontext, ständigem Denken, nativer Websuche sowie Text-, Bild- und Videoeingaben.

InternationalVeröffentlicht 15. Juli 20261M Kontext
Proprietärer EndpointNeu

Metas aktualisiertes Frontier-Reasoning-Modell mit einem Kontext von 1.048.576 Tokens, Bild-, Video-, Audio- und PDF-Verständnis, Websuche und Werkzeugaufrufen.

Veröffentlicht 5. Aug. 20261M Kontext
Save up to 7%

Kimi K2.7 Code

Moonshot AI
Proprietärer Endpoint

Kimi K2.7 Code ist Moonshots agentisches Codierungsmodell mit Billionen Parametern und 256K-Kontext, ständigem Denken sowie Text-, Bild- und Videoeingaben.

InternationalVeröffentlicht 16. Juni 2026256K Kontext
GermanyVeröffentlicht 16. Juni 2026256K Kontext
Proprietärer EndpointNeu

Meta-Frontier-Denkmodell mit einem Kontext von 1.048.576 Tokens sowie Bild-, Video-, Audio- und PDF-Verständnis, Websuche und Werkzeugaufrufen.

Veröffentlicht 9. Juli 20261M Kontext
Proprietärer EndpointNeu

Aktualisierter Multi-Agent-Conductor für hartes Denken, Codieren und Recherche, mit klarem Maximalaufwand, 1 Million Kontext, Bildeingabe und Websuche.

Veröffentlicht 23. Juli 20261M Kontext

Bilderzeugung14

Save up to 39%

FLUX.2 Klein 4B

Black Forest Labs
Native Inferenz

Apache-lizenziertes 4B FLUX.2 Klein-Bildgenerierungs- und Bearbeitungsmodell mit text-to-image, Referenzbildbearbeitung und kreativer Workflow-Unterstützung.

Veröffentlicht 15. Jan. 2026
Proprietärer Endpoint

Bildgenerierung und -bearbeitung Modelle, die Bilder aus Text oder Bildeingaben erstellt und modifiziert, mit Inpainting-, virtuellen Anprobierungs- und Stilsteuerungen.

Veröffentlicht 3. Dez. 2024
Proprietärer Endpoint

Open-Source-text-to-image modelliert eine multimodale Mix-of-Experts-Architektur mit fotorealistischer Detailgenauigkeit und starker mehrsprachiger Textwiedergabe.

Veröffentlicht 28. Sept. 2025
Proprietärer Endpoint

Autoregressives Framework auf dem Janus Pro 7B-Modell, das multimodales Verständnis und Bilderzeugung in einer Architektur vereint.

Veröffentlicht 27. Jan. 2025

Qwen Image 2.0

Alibaba Cloud
Proprietärer Endpoint

Vereinheitlichtes Bildgenerierungs- und Bearbeitungsmodell mit klassenführender komplexer Chinese/English Textrendering, realistischen Texturen und Multi-Bild-Fusion.

SingaporeVeröffentlicht 3. März 2026

Qwen Image 3.0

Alibaba Cloud
Proprietärer EndpointNeu

Qwen-Bildgenerierung und -bearbeitung mit Base- und Pro-Varianten, mehrsprachiger Typografie, mehrfachen Bildreferenzen und steuerbarer 1K- oder 2K-Ausgabe.

SingaporeVeröffentlicht 21. Juli 2026

Videoerzeugung23

Proprietärer EndpointNeu

Text-zu-Video und image-to-video mit synchronisiertem nativem Audio, auf 720p oder 1080p für 3 bis 15 Sekunden, mit Seitenverhältnis und Prompt-Steuerung.

Veröffentlicht 17. Juni 2026
Proprietärer Endpoint

Videogenerierungsmodell, das bis zu 2-minütige Mehrfachaufnahme-Videos aus Text und optionalen Bildeingaben mit verbesserter Qualität und Konsistenz erzeugt.

Veröffentlicht 7. Apr. 2025

HappyHorse 1.0

Alibaba Cloud
Proprietärer Endpoint

Das Videomodell bietet Text-zu-Video-, Bild-zu-Video-, Referenz-zu-Video- und Videobearbeitungsmodi mit hochauflösender, bewegungsglatter Ausgabe.

SingaporeVeröffentlicht 6. Mai 2026
Save up to 19%
Native Inferenz

8,3B-Parameter-Videomodell mit nativer 720p-Ausgabe (hochskalierbar auf 1080p), starker Bewegungskohärenz und bilingualem Prompt-Verständnis bis zu 10 Sekunden.

Veröffentlicht 20. Nov. 2025

Kling O3

Kling AI
Proprietärer Endpoint

Videomodelle im Standard- oder Pro-Modus mit Text-zu-Video, Bild-zu-Video, Referenz-zu-Video, Schnitt, nativem Ton und Mehrszenen-Übergängen.

Veröffentlicht 5. Feb. 2026
Proprietärer Endpoint

Kling 3.0 Modell, das Bewegung von einem Referenzvideo auf eine Figur aus einem Referenzbild überträgt, mit Standard-720p- und Pro 1080p-Stufen.

Audiogeneration14

Save up to 17%
Native Inferenz

Open-Source-Musikgenerierungsmodell für text-to-song und textgesteuerte Audio, mit schneller 8-Stufe XL Turbo-Inferenz für steuerbare Song-Iteration.

Veröffentlicht 2. Apr. 2026
Save up to 12%

TTS 2

Inworld
Proprietärer EndpointNeu

Echtzeit-Sprachmodell mit einfacher englischer Sprachsteuerung, einer Sprachidentität in 100+ Sprachen und Streaming-time-to-first-audio unter 200 ms.

Veröffentlicht 5. Mai 2026
Save up to 30%
Proprietärer Endpoint

Sub-130 ms TTFB-Sprachsynthese mit 271+ Stimmen in 15 Sprachen, expressive Prosodie und Echtzeit-SSE-Streaming für Voice-Agents mit niedriger Latenz.

Veröffentlicht 21. Jan. 2026
Save up to 15%
Proprietärer Endpoint

Broadcast-Qualitäts-Stimmsynthese mit reichhaltiger expressiver Prosodie, 271+ Stimmen in 15 Sprachen und Echtzeit-SSE-Streaming mit Zeitstempeln pro Wort.

Veröffentlicht 21. Jan. 2026
Proprietärer Endpoint

Latenzarte text-to-speech mit Ein- und Mehrlautsprecherstimmen sowie steuerbarem Stil, Akzent und ausdrucksstarkem Klang für Produktions-Apps.

Veröffentlicht 20. Mai 2025
Proprietärer Endpoint

Hochwertige TTS-Vorschau für Podcasts, Hörbücher und Kundensupport mit ausdrucksstarken Mehrsprecherstimmen in 23+ Sprachen.

Veröffentlicht 20. Mai 2025

Transkription4

Proprietärer Endpoint

Sprach-zu-Text-Transkription mit dem Nova-3-Modell mit mehrsprachiger Unterstützung und fortschrittlichen anpassbaren Einstellungen für Produktionsarbeitslasten.

Veröffentlicht 12. Feb. 2025
Proprietärer Endpoint

Whisper-1 speech-to-text Transkription, die auf mehrsprachiges, überwachtem Audio trainiert wurde, mit einem Upload-Limit von 25 MB pro Datei.

Veröffentlicht 21. Sept. 2022
Save up to 17%
Native Inferenz

Kontrollierte Whisper Large v3 Turbo-Transkription mit mehrsprachigem ASR, Übersetzung, VAD, Zeitstempeln, Untertiteln, Hotwords und Decoder-Steuerungen.

Veröffentlicht 1. Okt. 2024
Proprietärer EndpointNeu

StepFun Streaming-Spracherkennungsmodell für chinesische und englische Audiotranskription.

InternationalVeröffentlicht 24. Apr. 2026

Forschung & Suche13

Proprietärer Endpoint

Schnelle LLM-ähnliche Antwort auf eine Frage in natürlicher Sprache, basierend auf frischen Exa-Websuchergebnissen mit Inline-Zitaten und Quelllinks.

Proprietärer Endpoint

KI-gestützte Websuche mit detaillierten Übersichten und Antworten, schneller als Deep Search. Rang #1 im OpenAI SimpleQA-Benchmark.

100K Kontext
Proprietärer Endpoint

Institutionelle Forschung, gestützt auf Claude-Opus-4.6-Argumentation, mit maximaler Tiefe, erweitertem Werkzeugzugang und umfangreicher Quellenabdeckung.

Proprietärer Endpoint

Forschungsmodell für mehrstufige Abfindung, Synthese und Schlussfolgerung, bei dem Quellen über komplexe Themen hinweg autonom gesucht, gelesen und bewertet werden.

128K Kontext

3D-Generation1

Save up to 90%

TRELLIS.2 4B

Microsoft
Native Inferenz

TRELLIS.2 Bild-zu-3D-Modell, das ein Referenzbild in ein texturiertes GLB-Asset mit Auflösungs-, Seed-, Mesh-, Textur- und Exportkontrollen verwandelt.

Einbettungen3

Text Embedding v4

Alibaba Cloud
Proprietärer Endpoint

Mehrsprachige Texteinbettung mit wählbaren Ausgabedimensionen (64–2048). Bis zu 8.192 Token pro Eingabe.

SingaporeVeröffentlicht 4. Juni 20258K Kontext
Proprietärer Endpoint

Speed-optimised multimodal embedding, same shape as Vision-Plus, 3× cheaper image/video tokens.

SingaporeVeröffentlicht 23. Sept. 20251K Kontext
Proprietärer Endpoint

Multimodale Einbettung erzeugt unabhängige Vektoren für Text-, Bild- und Videoeingänge.

SingaporeVeröffentlicht 23. Sept. 20251K Kontext

Rerankers1

Qwen3 Rerank

Alibaba Cloud
Proprietärer Endpoint

Semantischer Dokument-Reranker. Sortiert bis zu 500 Kandidaten pro Abfrage nach Relevanz, unterstützt 100+ Sprachen und akzeptiert eine benutzerdefinierte Sortieranweisung.

SingaporeVeröffentlicht 5. Juni 20254K Kontext

Werkzeuge & Agenten2

GPTZero

GPTZero
Proprietärer Endpoint

Deep-Learning-Detektor, der Textabschnitte markiert, die wahrscheinlich von KI im Vergleich zu Menschen generiert wurden, und Inhalte als vollständig menschlich, KI oder gemischt klassifiziert.

Manus

Manus
Proprietärer Endpoint

Autonomer KI-Agent, der eine hochrangige Eingabeaufforderung in Unteraufgaben umwandelt, Werkzeuge und APIs aufruft und end-to-end Ergebnisse ohne manuelle Orchestrierung liefert.

Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.