
Flaggschiff-Multi-Agenten-Leiter für die schwierigsten Argumentations-, Codierungs- und Forschungsarbeiten, mit 1M Kontext, Bildeingabe und Websuche.
Flaggschiff-Multi-Agenten-Leiter für die schwierigsten Argumentations-, Codierungs- und Forschungsarbeiten, mit 1M Kontext, Bildeingabe und Websuche.
Unterstützt Text- und Bildeingaben, einen 1M-Token-Kontext, Funktionsaufrufe, strenge JSON-Schema-strukturierte Ausgabe und integrierte Websuche. Das Schließen ist immer aktiviert mit den Aufwandsniveaus hoch und xhoch; max wird als Alias von xhigh akzeptiert. Die Websuche erhebt keine separate Gebühr. Die vollständige Nutzung des Orchestrierungstokens wird zu den angezeigten Eingabe-, Ausgabe- und Cache-Raten berechnet.
Auch bekannt als Fugu Ultra, Sakana AI Fugu Ultra v2.0
fugu-ultra-v2-0/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-ultra-v2-0:generateContentfugu-ultra-v2.0sakana/fugu-ultra-v2-0sakana/fugu-ultra-v2.0Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Fugu Ultra v2.0 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID fugu-ultra-v2-0. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-ultra-v2-0",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v2-0",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Fugu Ultra v2.0 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 bis 131072 | Maximale Anzahl der Ausgabetoken für die endgültige Antwort. Muss mindestens 16 sein. Der Leiter braucht Platz zum Arbeiten, daher können sehr kleine Werte die... |
| reasoning_effort | enum | high | high, xhigh, max | Wie schwer Fugu Ultra v2.0 argumentiert. Reasoning ist immer aktiviert. Der Standard ist high; xhigh und max sind Aliase mit gleichem maximalen Aufwand. |
| tool_web_search | boolean | false | - | Aktivieren Sie die integrierte Websuche. Es gibt keine separate Gebühr; Die Suchkosten werden in den für die Anfrage berechneten Orchestrierungstoken widergespiegelt. |
| tools | array | [] | - | OpenAI-kompatible Funktionsaufruf-Werkzeugdefinitionen. |
| tool_choice | object | - | - | OpenAI-kompatible Werkzeugwahlsteuerung. |
| response_format | enum | - | - | Gib strukturierte JSON-Ausgabe zurück. Der JSON-Modus liefert jedes gültige JSON-Objekt zurück; Der JSON-Schema-Modus setzt genau das Schema vor, das du angibst. |
Fugu Ultra v2.0 ist der Flaggschiff-Multi-Agent-Leiter: Jede Anfrage koordiniert einen Pool von Expertenmodellen und fasst deren Arbeit zu einer einzigen Antwort zusammen. Latenz und Streaming – Antworten können bei komplexen Eingaben von wenigen Sekunden bis zu wenigen Minuten dauern. - Die vollständige Antwort wird nach Abschluss des Modells auf einmal zurückgegeben, nicht Token für Token. Streaming wird akzeptiert, aber am Ende wird die vollständige Antwort geliefert, anstatt die generierten Token zu streamen. - max_tokens müssen mindestens 16 sein. Lassen Sie großzügigen Headroom, da sehr kleine Limits die Antwort kürzen oder leerstellen können. Fähigkeiten - Text- und Bildeingabe mit 1M Token-Kontext. - Always-on-Argumentation. High ist der Standard, xhigh erhöht den Aufwand, und max wird als Alias von xhigh akzeptiert. - Funktionsaufruf, strikte JSON-Schema-Ausgabe und integrierte Websuche, die ihre Quellen zitiert, wenn sie verfügbar sind (keine separate Gebühr). Versionierung – Verwenden Sie fugu-ultra-v2-0 für v2.0. Die alte fugu-ultra-ID bleibt für Abwärtskompatibilität an v1.0 gepinnt und fugu-ultra-v1-1 liefert v1.1 weiter. Billing - Wird bei vollständiger Tokennutzung berechnet, einschließlich der intern verwendeten Orchestrierungstoken, sodass selbst kurze Prompts Kosten verursachen. - Kontext-tiered: Anfragen über insgesamt 272.00 Eingabetoken verwenden die höher angezeigte Rate.
Auf EmpirioLabs wird Fugu Ultra v2.0 nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Fugu Ultra v2.0 unterstützt ein Kontextfenster von 1M Token mit bis zu 131.072 Ausgabe-Token pro Antwort.
Ja. Fugu Ultra v2.0 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID fugu-ultra-v2-0 verwendest.
Ja. Der EmpirioLabs Playground führt Fugu Ultra v2.0 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.