Entdecken Sie unsere Produktion bereit KI-Modelle

Durchstöbern Sie den vollständigen Katalog der Modelle in Text, Bild, Audio, Video, 3D und mehr.

Modellkatalog

KI modelliert auf einer OpenAI-kompatiblen API.

Durchsuchen Sie Text-, Bild-, Video-, Audio-, 3D-, Such- und Agenten-Endpunkte mit pay-as-you-go Preisen. Der interaktive Katalog lädt die aktuelle Verfügbarkeit von EmpirioLabs, und diese Modelldokumentationen sind ohne Client-JavaScript crawlbar.

Open-Model-Dokumente

New & Featured

Proprietärer EndpointNeu

Coding and agentic model with a 1M token context, 128K output, always-on reasoning at low, high, or max effort, native web search, and tool calling.

SingaporeVeröffentlicht 14. Aug. 20261M Kontext
Save up to 84%

Qwen3.8 27B

Alibaba Cloud
Native InferenzNeu

Multimodal reasoner with 256K context, image and video input, function tools, structured JSON, and thinking on by default.

Veröffentlicht 14. Aug. 2026256K Kontext
Save up to 10%
Native InferenzNeu

Generates complete stereo songs from lyrics and a style prompt, with duration, seed, and format controls up to 5 minutes.

Veröffentlicht 13. Aug. 2026
Proprietärer EndpointNeu

Official 0813 Pro release with major gains across coding, repository work, tool use, and agent tasks, plus hybrid thinking and a 1M context window.

SingaporeVeröffentlicht 13. Aug. 20261M Kontext
Proprietärer EndpointNeu

Text-to-image plus multi-reference editing with up to three source images, selectable quality tiers, and 1K or 2K output resolution.

Veröffentlicht 7. Aug. 2026
Save up to 47%
Native InferenzNeu

Meta-offenes 30B-Agentenmodell mit Bildverständnis, 128K-Kontext, Werkzeugaufrufen, strukturierter Ausgabe und kontrollierbarer Argumentationsstärke.

Veröffentlicht 10. Aug. 2026128K Kontext

Textgenerierung69

Proprietärer EndpointNeu

Coding and agentic model with a 1M token context, 128K output, always-on reasoning at low, high, or max effort, native web search, and tool calling.

SingaporeVeröffentlicht 14. Aug. 20261M Kontext
Save up to 21%
Proprietärer Endpoint

Logik- und Codierungsmodell mit einem 1M Token-Kontext, 128K-Ausgabe, anpassbarem Schlussfolgerungsaufwand, nativer Websuche und Werkzeugaufrufen.

SingaporeVeröffentlicht 16. Juni 20261M Kontext
GermanyVeröffentlicht 16. Juni 20261M Kontext
United StatesVeröffentlicht 16. Juni 20261M Kontext

Kimi K3

Moonshot AI
Proprietärer EndpointNeu

Kimi K3 ist Moonshots Flaggschiff-Logikmodell mit einem 1-Millionen-Token-Kontext, ständigem Denken, nativer Websuche sowie Text-, Bild- und Videoeingaben.

InternationalVeröffentlicht 15. Juli 20261M Kontext
Proprietärer EndpointNeu

Metas aktualisiertes Frontier-Reasoning-Modell mit einem Kontext von 1.048.576 Tokens, Bild-, Video-, Audio- und PDF-Verständnis, Websuche und Werkzeugaufrufen.

Veröffentlicht 5. Aug. 20261M Kontext
Save up to 7%

Kimi K2.7 Code

Moonshot AI
Proprietärer Endpoint

Kimi K2.7 Code ist Moonshots agentisches Codierungsmodell mit Billionen Parametern und 256K-Kontext, ständigem Denken sowie Text-, Bild- und Videoeingaben.

InternationalVeröffentlicht 16. Juni 2026256K Kontext
GermanyVeröffentlicht 16. Juni 2026256K Kontext
Proprietärer EndpointNeu

Meta-Frontier-Denkmodell mit einem Kontext von 1.048.576 Tokens sowie Bild-, Video-, Audio- und PDF-Verständnis, Websuche und Werkzeugaufrufen.

Veröffentlicht 9. Juli 20261M Kontext

Bilderzeugung17

Save up to 39%

FLUX.2 Klein 4B

Black Forest Labs
Native Inferenz

Apache-lizenziertes 4B FLUX.2 Klein-Bildgenerierungs- und Bearbeitungsmodell mit text-to-image, Referenzbildbearbeitung und kreativer Workflow-Unterstützung.

Veröffentlicht 15. Jan. 2026
Proprietärer Endpoint

Bildgenerierung und -bearbeitung Modelle, die Bilder aus Text oder Bildeingaben erstellt und modifiziert, mit Inpainting-, virtuellen Anprobierungs- und Stilsteuerungen.

Veröffentlicht 3. Dez. 2024
Proprietärer Endpoint

Open-Source-text-to-image modelliert eine multimodale Mix-of-Experts-Architektur mit fotorealistischer Detailgenauigkeit und starker mehrsprachiger Textwiedergabe.

Veröffentlicht 28. Sept. 2025
Proprietärer Endpoint

Autoregressives Framework auf dem Janus Pro 7B-Modell, das multimodales Verständnis und Bilderzeugung in einer Architektur vereint.

Veröffentlicht 27. Jan. 2025

Qwen Image 2.0

Alibaba Cloud
Proprietärer Endpoint

Vereinheitlichtes Bildgenerierungs- und Bearbeitungsmodell mit klassenführender komplexer Chinese/English Textrendering, realistischen Texturen und Multi-Bild-Fusion.

SingaporeVeröffentlicht 3. März 2026

Qwen Image 3.0

Alibaba Cloud
Proprietärer EndpointNeu

Qwen-Bildgenerierung und -bearbeitung mit Base- und Pro-Varianten, mehrsprachiger Typografie, mehrfachen Bildreferenzen und steuerbarer 1K- oder 2K-Ausgabe.

SingaporeVeröffentlicht 21. Juli 2026

Videoerzeugung29

Proprietärer Endpoint

Text-zu-Video und image-to-video mit synchronisiertem nativem Audio, auf 720p oder 1080p für 3 bis 15 Sekunden, mit Seitenverhältnis und Prompt-Steuerung.

Veröffentlicht 17. Juni 2026
Proprietärer Endpoint

Videogenerierungsmodell, das bis zu 2-minütige Mehrfachaufnahme-Videos aus Text und optionalen Bildeingaben mit verbesserter Qualität und Konsistenz erzeugt.

Veröffentlicht 7. Apr. 2025

HappyHorse 1.0

Alibaba Cloud
Proprietärer Endpoint

Das Videomodell bietet Text-zu-Video-, Bild-zu-Video-, Referenz-zu-Video- und Videobearbeitungsmodi mit hochauflösender, bewegungsglatter Ausgabe.

SingaporeVeröffentlicht 6. Mai 2026
Save up to 19%
Native Inferenz

8,3B-Parameter-Videomodell mit nativer 720p-Ausgabe (hochskalierbar auf 1080p), starker Bewegungskohärenz und bilingualem Prompt-Verständnis bis zu 10 Sekunden.

Veröffentlicht 20. Nov. 2025

Kling O3

Kling AI
Proprietärer Endpoint

Videomodelle im Standard- oder Pro-Modus mit Text-zu-Video, Bild-zu-Video, Referenz-zu-Video, Schnitt, nativem Ton und Mehrszenen-Übergängen.

Veröffentlicht 5. Feb. 2026
Proprietärer Endpoint

Kling 3.0 Modell, das Bewegung von einem Referenzvideo auf eine Figur aus einem Referenzbild überträgt, mit Standard-720p- und Pro 1080p-Stufen.

Audiogeneration15

Save up to 17%
Native Inferenz

Open-Source-Musikgenerierungsmodell für text-to-song und textgesteuerte Audio, mit schneller 8-Stufe XL Turbo-Inferenz für steuerbare Song-Iteration.

Veröffentlicht 2. Apr. 2026
Save up to 12%

TTS 2

Inworld
Proprietärer EndpointNeu

Echtzeit-Sprachmodell mit einfacher englischer Sprachsteuerung, einer Sprachidentität in 100+ Sprachen und Streaming-time-to-first-audio unter 200 ms.

Veröffentlicht 5. Mai 2026
Save up to 30%
Proprietärer Endpoint

Sub-130 ms TTFB-Sprachsynthese mit 271+ Stimmen in 15 Sprachen, expressive Prosodie und Echtzeit-SSE-Streaming für Voice-Agents mit niedriger Latenz.

Veröffentlicht 21. Jan. 2026
Save up to 15%
Proprietärer Endpoint

Broadcast-Qualitäts-Stimmsynthese mit reichhaltiger expressiver Prosodie, 271+ Stimmen in 15 Sprachen und Echtzeit-SSE-Streaming mit Zeitstempeln pro Wort.

Veröffentlicht 21. Jan. 2026
Save up to 10%
Native InferenzNeu

Generates complete stereo songs from lyrics and a style prompt, with duration, seed, and format controls up to 5 minutes.

Veröffentlicht 13. Aug. 2026
Proprietärer Endpoint

Latenzarte text-to-speech mit Ein- und Mehrlautsprecherstimmen sowie steuerbarem Stil, Akzent und ausdrucksstarkem Klang für Produktions-Apps.

Veröffentlicht 20. Mai 2025

Transkription4

Proprietärer Endpoint

Sprach-zu-Text-Transkription mit dem Nova-3-Modell mit mehrsprachiger Unterstützung und fortschrittlichen anpassbaren Einstellungen für Produktionsarbeitslasten.

Veröffentlicht 12. Feb. 2025
Proprietärer Endpoint

Whisper-1 speech-to-text Transkription, die auf mehrsprachiges, überwachtem Audio trainiert wurde, mit einem Upload-Limit von 25 MB pro Datei.

Veröffentlicht 21. Sept. 2022
Save up to 17%
Native Inferenz

Kontrollierte Whisper Large v3 Turbo-Transkription mit mehrsprachigem ASR, Übersetzung, VAD, Zeitstempeln, Untertiteln, Hotwords und Decoder-Steuerungen.

Veröffentlicht 1. Okt. 2024
Proprietärer EndpointNeu

StepFun Streaming-Spracherkennungsmodell für chinesische und englische Audiotranskription.

InternationalVeröffentlicht 24. Apr. 2026

Forschung & Suche13

Proprietärer Endpoint

Schnelle LLM-ähnliche Antwort auf eine Frage in natürlicher Sprache, basierend auf frischen Exa-Websuchergebnissen mit Inline-Zitaten und Quelllinks.

Proprietärer Endpoint

KI-gestützte Websuche mit detaillierten Übersichten und Antworten, schneller als Deep Search. Rang #1 im OpenAI SimpleQA-Benchmark.

100K Kontext
Proprietärer Endpoint

Institutionelle Forschung, gestützt auf Claude-Opus-4.6-Argumentation, mit maximaler Tiefe, erweitertem Werkzeugzugang und umfangreicher Quellenabdeckung.

Proprietärer Endpoint

Forschungsmodell für mehrstufige Abfindung, Synthese und Schlussfolgerung, bei dem Quellen über komplexe Themen hinweg autonom gesucht, gelesen und bewertet werden.

128K Kontext

3D-Generation3

Save up to 90%

TRELLIS.2 4B

Microsoft
Native Inferenz

TRELLIS.2 Bild-zu-3D-Modell, das ein Referenzbild in ein texturiertes GLB-Asset mit Auflösungs-, Seed-, Mesh-, Textur- und Exportkontrollen verwandelt.

Proprietärer Endpoint

Rodin Gen-2 engine that turns a text prompt or up to five reference images into production 3D assets with PBR materials and quad or raw meshes.

MalaysiaVeröffentlicht 1. Okt. 2025
Proprietärer Endpoint

Production-focused image-to-3D with structure-aware textures, 1536 and 1536 Pro precision tiers, meshes up to two million faces, and five export formats.

Malaysia

Einbettungen4

Text Embedding v4

Alibaba Cloud
Proprietärer Endpoint

Mehrsprachige Texteinbettung mit wählbaren Ausgabedimensionen (64–2048). Bis zu 8.192 Token pro Eingabe.

SingaporeVeröffentlicht 4. Juni 20258K Kontext
Proprietärer Endpoint

Speed-optimised multimodal embedding, same shape as Vision-Plus, 3× cheaper image/video tokens.

SingaporeVeröffentlicht 23. Sept. 20251K Kontext
Proprietärer Endpoint

Multimodale Einbettung erzeugt unabhängige Vektoren für Text-, Bild- und Videoeingänge.

SingaporeVeröffentlicht 23. Sept. 20251K Kontext
Proprietärer Endpoint

Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.

MalaysiaVeröffentlicht 28. Juni 20258K Kontext

Rerankers1

Qwen3 Rerank

Alibaba Cloud
Proprietärer Endpoint

Semantischer Dokument-Reranker. Sortiert bis zu 500 Kandidaten pro Abfrage nach Relevanz, unterstützt 100+ Sprachen und akzeptiert eine benutzerdefinierte Sortieranweisung.

SingaporeVeröffentlicht 5. Juni 20254K Kontext

Werkzeuge & Agenten2

GPTZero

GPTZero
Proprietärer Endpoint

Deep-Learning-Detektor, der Textabschnitte markiert, die wahrscheinlich von KI im Vergleich zu Menschen generiert wurden, und Inhalte als vollständig menschlich, KI oder gemischt klassifiziert.

Manus

Manus
Proprietärer Endpoint

Autonomer KI-Agent, der eine hochrangige Eingabeaufforderung in Unteraufgaben umwandelt, Werkzeuge und APIs aufruft und end-to-end Ergebnisse ohne manuelle Orchestrierung liefert.

Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.
Keine Gegenstände gefunden.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.