Zuhause Blog

Wie man die Fugu Max API verwendet

Wie man die Fugu Max API verwendet

Sep 11, 2026

EmpirioLabs AI

Fugu Max ist auf EmpirioLabs verfügbar. Fugu ist kein einzelnes Modell. Es ist ein Leiter: Ein API-Aufruf breitet die Anfrage über einen Pool von Expertenmodellen aus und fasst ihre Arbeit zu einer einzigen Antwort zusammen. Fugu Max ist das kosteneffiziente Mitglied dieser Familie, das auf den breitesten Pool zurückgreift, den Sakana zusammengestellt hat, einschließlich Open-Weight- und Spezialmodelle, und für jede Aufgabe ein passendes Team zusammenstellt, anstatt immer die teuerste Option zu wählen.

Was Fugu Max unterstützt

Fugu Max nimmt Text- und Bildeingaben mit einem 1M Token-Kontextfenster entgegen. Es unterstützt Funktionsaufrufe, strenge JSON-Schema-strukturierte Ausgabe und integrierte Websuche mit Seitenabruf. Schlussfolgerung ist immer aktiviert.

Die Ausgabe ist auf 131.072 Token pro Anfrage begrenzt. Die Bildeingabe wird über die normalen OpenAI-kompatiblen Inhaltsteile akzeptiert, und EmpirioLabs übernimmt die Upload-Leitung für dich.

Wie man Fugu Max nennt

Verwenden Sie den OpenAI-kompatiblen Chat-Completions-Endpunkt und setzen Sie es ein modell zu Fugu-Max:

curl https://api.empiriolabs.ai/v1/chat/completions \ -h 'Authorization: Bearer $EMPIRIOLABS_API_KEY' \ -H 'Content-Type: application/json' \ -d '{ "model": "fugu-max", "messages": [ { "role": "user", "content": "Vergleichen Sie drei Ansätze zur Rate-Limitierung einer öffentlichen API und empfehlen Sie einen für einen 5000-req/s-Service." } ] }'

Das gleiche Modell ist über die Responses-, Messages- und Google-kompatiblen Inhaltsgenerierungs-Endpunkte verfügbar. Der Wechsel von einem anderen Fugu-Modell ist eine einzeilige Änderung, da der Request- und Response-Vertrag identisch ist.

Websuche und strukturierte Ergebnisse

Setz tool_web_search zu Stimmt wenn eine Antwort aktuelle Informationen benötigt. Das Modell führt eigene Suchanfragen und Seitenabrufe durch, zitiert Quellen, wenn es welche hat, und berichtet genau, was es verwendet hat usage.tool_usageZum Beispiel {"web_search": 3, "web_extractor": 1}. Diese Zählungen sind abrechenbar und bereits in den gemeldeten Kosten enthalten.

Für maschinenlesbare Ausgaben gib ein striktes JSON-Schema ein response_format. Fugu Max gibt genau konformes JSON zurück, sodass man das Ergebnis ohne Reparaturschritt analysieren kann.

Drei Dinge, die Anrufer falsch machen

1. Die Token-Zahlen sind größer als dein Prompt. Da der Dirigent arbeitet, indem er sich auf andere Modelle verteilt, ist die Orchestrierung, die er ausführt, reale Tokennutzung und wird als gewöhnliche Ein- und Ausgabetoken angegeben. Ein Ein-Satz-Prompt mit aktivierter Websuche kann Zehntausende von Eingabetoken anzeigen. Das ist zu erwarten, kein Fehler, und deshalb ist das zurückgesendete Verwendung Block ist die Zahl, gegen die du budgetieren solltest, und nicht die Länge deiner eigenen Nachricht.

2. Streaming kommt nicht token für token an. Stream: Wahr wird akzeptiert und ist nützlich, um lange Anfragen am Leben zu halten, aber der Dirigent puffert die gesamte Orchestrierung und liefert am Ende die Begründung und die Antwort in einem einzigen Burst. Wenn deine Benutzeroberfläche einen Tippeffekt zeigt, kannst du damit rechnen, dass er untätig bleibt und dann sofort einfließt.

3. Es existieren nur drei Argumentationsebenen. reasoning effort Nimmt an hoch, xhigh, und max, und sonst nichts. Senden Niedrig, Medium, oder nicht bringt 400 zurück. Auf Fugu Max, max wird als Alias von akzeptiert xhigh. Das Denken kann nicht abgeschaltet werden. Getrennt, max_tokens muss mindestens 16 sein, und kleine Werte können die Antwort abschneiden oder leeren, weil der Leiter Platz zum Arbeiten braucht.

Preisgestaltung

Fugu Max ist Pay-as-you-go ohne Abonnement und ist das einzige Fugu-Modell mit einer einheitlichen Set-Token-Rate bei jeder Kontextlänge, sodass ein langer Prompt niemals auf eine höhere Stufe versetzt. Eingebaute Websuche und Page Fetch werden pro ausgeführtem Aufruf über Token abgerechnet, und eine einzelne Anfrage kann mehr als eines ausführen. Aktuelle Raten für Eingabe, Ausgabe, zwischengespeicherte Eingaben und die Pro-Call-Webtools sind auf dem Fugu Max Modellseite und die preisseite, die immer den Live-Katalog wiedergeben.

Probier es mal

Führe einen Prompt in der spielplatz, oder die vollständige Parameterreferenz in der API-Doku.

Bereit, bessere Endpunkte zu nutzen?

Entdecken Sie unsere Modelle oder kontaktieren Sie uns bei Geschäftsanfragen, individuellen Deployments oder sonst etwas.