Fugu Max API

Kosteneffizienter Multi-Agent-Conductor, der pro Aufgabe ein passendes Expertenteam zusammenstellt, mit 1 Million Kontext, Bildeingabe und Websuche.

Sakana AITextgenerierung1M KontextVeröffentlicht 10. Sept. 2026Proprietärer EndpointNeu

Über Fugu Max

Kosteneffizienter Multi-Agent-Conductor, der pro Aufgabe ein passendes Expertenteam zusammenstellt, mit 1 Million Kontext, Bildeingabe und Websuche.

Unterstützt Text- und Bildeingaben, einen 1M-Token-Kontext, Funktionsaufrufe, strikte JSON-Schema-strukturierte Ausgabe und integrierte Websuche. Das Schließen ist immer aktiviert mit hohen und xhigh; max wird als Alias von xhigh akzeptiert. Eine feste Token-Rate bei jeder Kontextlänge. Eingebaute Websuche und Page-Fetch-Rechnung pro ausgeführter Aufruf. Die vollständige Orchestrierungs-Token-Nutzung wird zu den angezeigten Eingabe-, Ausgabe- und Cache-Raten berechnet.

Auch bekannt als Sakana AI Fugu Max

reasoningmultimodalweb searchfunction callingagentic codingstructured outputcache

Fugu Max Spezifikationen

Modell-ID
fugu-max
Autor
Sakana AI
Kategorie
Textgenerierung
Veröffentlicht
10. Sept. 2026
Kontextfenster
1M Token
Max. Ausgabe
131.072 Token
Eingabe
TextBild
Ausgabe
Text
Strukturierte Ausgabe
JSON Schema
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-max:generateContent
Alternative Modell-IDs
fugu-max-v1.0sakana/fugu-maxsakana/fugu-max-v1.0

Fugu Max API-Preise

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$2.00
Ausgabe
pro 1 Million generierter Token
$6.00
Implizite Cache-Leseart
pro 1M zwischengespeicherten Eingabetoken
$0.25
Web-Suche
pro Aufruf beim Aufruf
$0.007
Netzextraktor
pro Aufruf beim Aufruf
$0.007
Auf der vollständigen Preisseite vergleichen

So rufst du die Fugu Max API auf

Fugu Max bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID fugu-max. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "fugu-max",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="fugu-max",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige Fugu Max API-Referenz

Fugu Max API-Parameter

Request-Parameter, die die Fugu Max API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
max_tokensinteger3276816 bis 131072Maximale Anzahl der Ausgabetoken für die endgültige Antwort. Muss mindestens 16 sein. Der Leiter braucht Platz zum Arbeiten, daher können sehr kleine Werte die...
reasoning_effortenumhighhigh, xhigh, maxWie stark Fugu Max argumentiert. Das Schließen ist immer aktiviert. Der Standard ist hoch; xhigh und max sind Aliase mit demselben maximalen Aufwand.
tool_web_searchbooleanfalse-Aktivieren Sie die integrierte Websuche. Erhöht $0.007 die Anforderungskosten für jeden aufgerufenen Aufruf, und eine einzelne Anfrage kann mehr als einen Aufruf...
toolsarray[]-OpenAI-kompatible Funktionsaufruf-Werkzeugdefinitionen.
tool_choiceobject--OpenAI-kompatible Werkzeugwahlsteuerung.
response_formatenum--Gib strukturierte JSON-Ausgabe zurück. Der JSON-Modus liefert jedes gültige JSON-Objekt zurück; Der JSON-Schema-Modus setzt genau das Schema vor, das du angibst.

Gut zu wissen

Fugu Max ist der kosteneffiziente Multi-Agent-Leiter: Jede Anfrage stellt ein passendes Team von Expertenmodellen für die Aufgabe zusammen und fasst deren Arbeit in einer einzigen Antwort zusammen. Latenz und Streaming – Einfache Prompts kehren meist innerhalb weniger Sekunden zurück, und schwerere Prompts dauern länger, während der Leiter arbeitet. - Die vollständige Antwort wird sofort zurückgegeben, wenn das Modell fertig ist, nicht Token für Token. Streaming wird akzeptiert, liefert aber am Ende die vollständige Antwort statt Streaming-Tokens. - max_tokens müssen mindestens 16 sein. Lassen Sie großzügigen Spielraum, da sehr kleine Limits die Antwort kürzen oder leeren können. Fähigkeiten - Text- und Bildeingabe mit 1M Token-Kontext. - Always-on-Argumentation. High ist Standard, xhigh erhöht den Aufwand, und Max wird als Alias von xhigh akzeptiert. - Funktionsaufruf, strikte JSON-Schema-strukturierte Ausgabe und integrierte Websuche, die ihre Quellen zitiert, wenn verfügbar. Billing – Wird bei der vollen Tokennutzung abgerechnet, einschließlich der internen Orchestrierungstoken, die das Modell nutzt, sodass selbst kurze Prompts Kosten verursachen. - Ein fester Token-Satz bei jeder Kontextlänge, ohne höheren Satz für lange Prompts. - Eingebaute Websuche und Page Fetch werden pro ausgeführtem Aufruf zu den angegebenen Raten abgerechnet, und eine einzelne Anfrage kann mehr als einen Aufruf ausführen.

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

Fugu Max API: häufige Fragen

Wie viel kostet die Fugu Max API?

Auf EmpirioLabs wird Fugu Max nach Verbrauch abgerechnet: Eingabe $2.00 pro 1M Prompt-Token; Output $6.00 pro 1 Million generierter Token; Implizite Cache-Leseart $0.25 pro 1M zwischengespeicherten Eingabetoken. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von Fugu Max?

Fugu Max unterstützt ein Kontextfenster von 1M Token mit bis zu 131.072 Ausgabe-Token pro Antwort.

Ist die Fugu Max API OpenAI-kompatibel?

Ja. Fugu Max bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID fugu-max verwendest.

Kann ich Fugu Max im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Fugu Max im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Fugu Max API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.