Fugu Ultra v2.0 ist auf EmpirioLabs verfügbar. Fugu ist kein einzelnes Modell. Es ist ein Leiter: Ein API-Aufruf verteilt die Anfrage auf einen Pool von Expertenmodellen und fasst deren Arbeit zu einer einzigen Antwort zusammen. Ultra ist das Flaggschiff dieser Familie, und v2.0 ist auf maximale Fähigkeiten bei komplexen, mehrstufigen Aufgaben wie autonomem Denken, Forschung und Softwareentwicklung optimiert.
Was Fugu Ultra v2.0 unterstützt
Fugu Ultra v2.0 nimmt Text- und Bildeingaben mit einem 1M großen Token-Kontextfenster auf. Es unterstützt Funktionsaufrufe, strenge JSON-Schema-strukturierte Ausgabe und eine integrierte Websuche, die die Quellen zitiert, wenn sie verfügbar sind. Das Schließen ist immer aktiv, und die Ausgabe ist auf 131.072 Token pro Anfrage begrenzt.
Wie man Fugu Ultra v2.0 aufruft
Verwenden Sie den OpenAI-kompatiblen Chat-Completions-Endpunkt und setzen Sie es ein modell zu fugu-ultra-v2-0:
curl https://api.empiriolabs.ai/v1/chat/completions \ -h 'Authorization: Bearer $EMPIRIOLABS_API_KEY' \ -H 'Content-Type: application/json' \ -d '{ "model": "fugu-ultra-v2-0", "reasoning_effort": "xhigh", "messages": [ { "role": "user", "content": "entwerfen Sie einen Migrationsplan, um einen vielbesetzten, schreibintensiven Service auf eine neue Datenbank zu übertragen und zu markieren, was schiefgehen könnte." } ] }'
Dasselbe Modell ist über die Responses, Messages und Google-kompatible Inhaltsgenerierungs-Endpunkte verfügbar. Wenn der Leiter eine Schlussfassung zurückgibt, ergibt sie sich wie folgt message.reasoning_content neben der Antwort.
Wechsel von Version 1.0 oder Version 1.1
Die Versions-IDs sind explizit und gepinnt, sodass sich nichts unter dir bewegt. fugu-ultra-v1-0 und fugu-ultra-v1-1 Liefern Sie weiterhin ihre eigenen Schnappschüsse und das Vermächtnis fugu-ultra id bleibt an v1.0 gebunden. Der Wechsel zu v2.0 ist eine einzeilige Änderung.
Ein echter Verhaltensunterschied, den du vor der Migration überprüfen solltest: v1.1 Treats max als eine unmittelbare maximale Schlussfolgerungsstufe oben xhigh. In Version 2.0, max wird als Alias von akzeptiert xhigh. Code, der absichtlich zu Version 1.1 griff max Läuft weiterhin auf Version 2.0, wählt aber jetzt denselben Aufwand wie xhigh.
Drei Dinge, die Anrufer falsch machen
1. Die Token-Zahlen sind größer als dein Prompt. Der Fan-out des Conductors zu anderen Modellen ist die reale Tokennutzung, die als gewöhnliche Eingabe- und Ausgabetoken bezeichnet wird. Ein kurzer Prompt mit aktivierter Websuche kann eine sechsstellige Anzahl der Eingabetoken angeben. Budgetierung gegen die zurückgegebenen Token Verwendung Blockieren, nicht die Länge deiner eigenen Nachricht.
2. Die Kontextstufe wird durch die abgerechnete Eingabe ausgewählt, nicht durch Ihren Prompt. Fugu Ultra v2.0 hat eine höhere Rate über 272K Eingabetokens, und diese Schwelle wird für den vollen Eingabe einschließlich Orchestrierung gemessen. Ein bescheidener Prompt kann also bei einer schweren Anfrage immer noch in der höheren Stufe landen. Wenn dir die Stabilität der Stufe wichtiger ist als die Spitzenkapazität, hat Fugu Max bei jeder Kontextlänge einen Pauschrate.
3. Streaming kommt nicht token für token an. Stream: Wahr wird angenommen und hält lange Anfragen am Leben, aber der Dirigent puffert die gesamte Orchestrierung und liefert die Begründung und die Antwort in einem einzigen Burst am Ende. Anfragen können von wenigen Sekunden bis zu wenigen Minuten dauern, also setze großzügige Timeouts für den Client. Außerdem beachten Sie max_tokens muss mindestens 16 sein, und kleine Werte können die Antwort abschneiden oder leeren.
Preisgestaltung
Fugu Ultra v2.0 ist Pay-as-you-go ohne Abonnement. Eingabe-, Ausgabe- und zwischengespeicherte Eingaben sind kontextstufengebunden, mit einem höheren Satz über 272.000 Eingabetokens, und zwischengespeicherte Eingaben werden zu einem starken Rabatt gegenüber normalen Eingaben berechnet. Eingebaute Websuche erhebt keine separate Gebühr für Ultra, da die Kosten bereits in den Orchestrierungstoken liegen. Die aktuellen Tarife sind auf dem Fugu Ultra v2.0 Modellseite und die preisseite, die immer den Live-Katalog wiedergeben.
Probier es mal
Führe einen Prompt in der spielplatz, oder die vollständige Parameterreferenz in der API-Doku.



