
Originaler Multi-Agent-Leiter für hartes Schließen, Codieren und Recherche, mit 1M-Kontext, Bildeingabe, Funktionsaufrufen und Websuche.
Originaler Multi-Agent-Leiter für hartes Schließen, Codieren und Recherche, mit 1M-Kontext, Bildeingabe, Funktionsaufrufen und Websuche.
Unterstützt Text- und Bildeingaben, einen 1M-Token-Kontext, Funktionsaufrufe, strukturierte Ausgabe im JSON-Modus und integrierte Websuche. Das Schließen ist immer aktiviert mit Anstrengungsstufen hoch, xhoch und maximal; xhigh und max sind Aliase in Version 1.0. Die Websuche erhebt keine separate Gebühr. Die vollständige Nutzung des Orchestrierungstokens wird zu den angezeigten Eingabe-, Ausgabe- und Cache-Raten berechnet.
Auch bekannt als Fugu Ultra, Sakana AI Fugu Ultra v1.0
fugu-ultra-v1-0/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-ultra-v1-0:generateContentfugu-ultrafugu-ultra-20260615fugu-ultra-v1.0sakana/fugu-ultrasakana/fugu-ultra-20260615sakana/fugu-ultra-v1-0sakana/fugu-ultra-v1.0Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Fugu Ultra v1.0 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID fugu-ultra-v1-0. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-ultra-v1-0",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v1-0",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Fugu Ultra v1.0 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 bis 131072 | Maximale Anzahl der Ausgabetoken für die endgültige Antwort. Muss mindestens 16 sein. Der Leiter braucht Platz zum Arbeiten, daher können sehr kleine Werte die... |
| reasoning_effort | enum | high | high, xhigh, max | Wie schwer Fugu Ultra v1.0 ist. Das Denken ist immer an. Der Standard ist hoch; xhigh und max sind Aliase mit gleichem maximalen Aufwand. |
| tool_web_search | boolean | false | - | Aktivieren Sie die integrierte Websuche. Es gibt keine separate Gebühr; Die Suchkosten werden in den für die Anfrage berechneten Orchestrierungstoken widergespiegelt. |
| tools | array | [] | - | OpenAI-kompatible Funktionsaufruf-Werkzeugdefinitionen. |
| tool_choice | object | - | - | OpenAI-kompatible Werkzeugwahlsteuerung. |
| response_format | enum | - | - | Geben Sie die Ausgabe als gültiges JSON-Objekt (JSON-Modus) zurück. Beschreibe die Felder, die du in deinem Prompt verwenden möchtest. |
Fugu Ultra v1.0 ist der ursprüngliche Multi-Agent-Leiter: Jede Anfrage koordiniert einen Pool von Expertenmodellen und fasst deren Arbeit in einer einzigen Antwort zusammen. Latenz und Streaming – Antworten können bei komplexen Eingabeaufforderungen von wenigen Sekunden bis Minuten dauern. - Die vollständige Antwort wird alle auf einmal zurückgegeben, wenn das Modell fertig ist, nicht Token für Token. Streaming wird akzeptiert, liefert aber am Ende die vollständige Antwort, anstatt Token, sobald sie generiert werden. - max_tokens muss mindestens 16 Jahre alt sein. Lassen Sie großzügigen Headroom, da sehr kleine Limits die Antwort verkürzen oder leeren können. Fähigkeiten – Text- und Bildeingabe mit einem 1M Token-Kontext. - Immer angehendes Denken. hoch ist der Standard; xhigh und max sind Aliase mit gleichem maximalen Aufwand. - Funktionsaufruf, JSON-Modus und integrierte Websuche, die ihre Quellen zitiert, wenn verfügbar (ohne separate Gebühr). Kompatibilität – Die alten Fugu-Ultra-, fugu-ultra-20260615- und sakana/fugu-ultra-IDs sind weiterhin an dieser Version gepinnt. Billing – Wird bei der vollständigen Tokennutzung abgerechnet, einschließlich der internen Orchestrierungstoken, die das Modell nutzt, sodass selbst kurze Prompts Kosten verursachen. - Kontext-tiered: Anfragen über insgesamt 272K Eingabetoken verwenden die höher angezeigte Rate.
Auf EmpirioLabs wird Fugu Ultra v1.0 nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Fugu Ultra v1.0 unterstützt ein Kontextfenster von 1M Token mit bis zu 131.072 Ausgabe-Token pro Antwort.
Ja. Fugu Ultra v1.0 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID fugu-ultra-v1-0 verwendest.
Ja. Der EmpirioLabs Playground führt Fugu Ultra v1.0 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.