
Aktualisierter Multi-Agent-Conductor für hartes Denken, Codieren und Recherche, mit klarem Maximalaufwand, 1 Million Kontext, Bildeingabe und Websuche.
Aktualisierter Multi-Agent-Conductor für hartes Denken, Codieren und Recherche, mit klarem Maximalaufwand, 1 Million Kontext, Bildeingabe und Websuche.
Unterstützt Text- und Bildeingaben, einen 1-Millionen-Token-Kontext, Funktionsaufrufe, strikte JSON-Schema-strukturierte Ausgabe und integrierte Websuche. Das Schließen ist immer mit hoch, xhoch und einem deutlichen maximalen Einsatz an. Die Websuche erhebt keine separate Gebühr. Die vollständige Nutzung des Orchestrierungstokens wird zu den angezeigten Eingabe-, Ausgabe- und Cache-Raten berechnet.
Auch bekannt als Fugu Ultra, Sakana AI Fugu Ultra v1.1
fugu-ultra-v1-1/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-ultra-v1-1:generateContentfugu-ultra-v1.1sakana/fugu-ultra-v1-1sakana/fugu-ultra-v1.1Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Fugu Ultra v1.1 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID fugu-ultra-v1-1. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-ultra-v1-1",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v1-1",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Fugu Ultra v1.1 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 bis 131072 | Maximale Anzahl der Ausgabetoken für die endgültige Antwort. Muss mindestens 16 sein. Der Leiter braucht Platz zum Arbeiten, daher können sehr kleine Werte die... |
| reasoning_effort | enum | high | high, xhigh, max | Wie schwer Fugu Ultra v1.1 es ist. Das Denken ist immer an. High balanciert Geschwindigkeit und Leistung aus, Xhigh liefert tiefgehendes Schließen für komplexe... |
| tool_web_search | boolean | false | - | Aktivieren Sie die integrierte Websuche. Es gibt keine separate Gebühr; Die Suchkosten werden in den für die Anfrage berechneten Orchestrierungstoken widergespiegelt. |
| tools | array | [] | - | OpenAI-kompatible Funktionsaufruf-Werkzeugdefinitionen. |
| tool_choice | object | - | - | OpenAI-kompatible Werkzeugwahlsteuerung. |
| response_format | enum | - | - | Gib strukturierte JSON-Ausgabe zurück. Der JSON-Modus liefert jedes gültige JSON-Objekt zurück; Der JSON-Schema-Modus setzt genau das Schema vor, das du angibst. |
Fugu Ultra v1.1 ist ein aktualisierter Multi-Agent-Leiter: Jede Anfrage koordiniert einen Pool von Expertenmodellen und fasst deren Arbeit in einer einzigen Antwort zusammen. Latenz und Streaming – Antworten können bei komplexen Eingabeaufforderungen von wenigen Sekunden bis Minuten dauern. - Die vollständige Antwort wird alle auf einmal zurückgegeben, wenn das Modell fertig ist, nicht Token für Token. Streaming wird akzeptiert, liefert aber am Ende die vollständige Antwort, anstatt Token, sobald sie generiert werden. - max_tokens muss mindestens 16 Jahre alt sein. Lassen Sie großzügigen Headroom, da sehr kleine Limits die Antwort verkürzen oder leeren können. Fähigkeiten – Text- und Bildeingabe mit einem 1M Token-Kontext. - Immer eingeschaltetes Schließen mit hoch, xhoch und einem klaren Maximallevel für die schwierigsten Probleme. - Funktionsaufrufe, strikte JSON-Schema-strukturierte Ausgabe und integrierte Websuche, die ihre Quellen zitiert, wenn verfügbar (keine separate Gebühr). Versionierung – Nutze fugu-ultra-v1-1 für Version 1.1. Das Legacy Fugu-Ultra id bleibt für Abwärtskompatibilität an Version 1.0 gepinnt. Billing – Wird bei der vollständigen Tokennutzung abgerechnet, einschließlich der internen Orchestrierungstoken, die das Modell nutzt, sodass selbst kurze Prompts Kosten verursachen. - Kontext-tiered: Anfragen über insgesamt 272K Eingabetoken verwenden die höher angezeigte Rate.
Auf EmpirioLabs wird Fugu Ultra v1.1 nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Fugu Ultra v1.1 unterstützt ein Kontextfenster von 1M Token mit bis zu 131.072 Ausgabe-Token pro Antwort.
Ja. Fugu Ultra v1.1 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID fugu-ultra-v1-1 verwendest.
Ja. Der EmpirioLabs Playground führt Fugu Ultra v1.1 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.