Accueil Blog

Comment utiliser l’API Fugu Ultra v2.0

Comment utiliser l’API Fugu Ultra v2.0

Sep 11, 2026

EmpirioLabs AI

Fugu Ultra v2.0 est disponible en EmpirioLabs. Fugu n’est pas un modèle unique. C’est un conducteur: un appel API diffuse la requête à travers un pool de modèles experts et compose leur travail en une seule réponse. Ultra est le modèle phare de cette famille, et la version 2.0 est optimisée pour ses capacités de pointe sur des travaux complexes et en plusieurs étapes tels que le raisonnement autonome, la recherche et le développement logiciel.

Ce que prend en charge Fugu Ultra v2.0

Fugu Ultra v2.0 prend en charge la saisie de texte et d’images avec une fenêtre de contexte de jeton de 1M. Il supporte l’appel de fonctions, une sortie structurée strictement JSON Schema, et la recherche web intégrée qui cite ses sources lorsqu’elles sont disponibles. Le raisonnement est toujours activé, et la sortie est limitée à 131 072 jetons par requête.

Comment appeler Fugu Ultra v2.0

Utilisez le point de terminaison de complétions de chat compatible OpenAI et définissez modèle à fugu-ultra-v2-0:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorisation: Porteur $EMPIRIOLABS_API_KEY' \ -H 'Type-de-contenu: application/json' \ -d '{ « modèle »: « fugu-ultra-v2-0 », « reasoning_effort »: « xhigh », « messages »: [ { « rôle »: « utilisateur », « contenu »: « Concevoir un plan de migration pour déplacer un service très chargé en écriture vers une nouvelle base de données, et signaler ce qui pourrait mal tourner. » } ] }'

Le même modèle est disponible via les points de terminaison de génération de contenu compatibles avec Google, Responses, Messages. Lorsque le conducteur renvoie un résumé de raisonnement, il apparaît comme message.reasoning_content Avec la réponse.

Passage de la v1.0 ou v1.1

Les identifiants de version sont explicites et épinglés, donc rien ne bouge sous vous. fugu-ultra-v1-0 et fugu-ultra-v1-1 Continuez à servir leurs propres instantanés, et l’héritage fugu-ultra ID reste épinglé à la v1.0. Passer à la v2.0 est un changement en une seule ligne.

Une vraie différence de comportement à vérifier avant de migrer: les traitements v1.1 max comme un niveau de raisonnement maximal distinct au-dessus xhigh. Sur la version 2.0, max est accepté comme un alias de xhigh. Code qui visait délibérément les v1.1 max Ça tourne toujours en v2.0, mais il sélectionne désormais la même force que xhigh.

Trois choses que les appelants se trompent

1. Le nombre de jetons est plus important que votre demande. La dispersion du conducteur vers d’autres modèles correspond à une utilisation réelle des jetons, présentée comme des jetons d’entrée et de sortie ordinaires. Une courte invite avec la recherche web activée peut rapporter un compte de jetons d’entrée à six chiffres. Budget contre les revenus Utilisation Bloquer, pas la longueur de ton propre message.

2. Le niveau de contexte est choisi par l’entrée facturée, pas par votre prompt. Fugu Ultra v2.0 a un débit plus élevé au-delà de 272K jetons d’entrée, et ce seuil est mesuré sur l’entrée pleine facturée, y compris l’orchestration. Ainsi, une demande modérée peut toujours être placée dans le niveau supérieur sur une demande lourde. Si la stabilité des niveaux compte plus pour vous que la capacité de pointe, Fugu Max propose un taux fixe à chaque longueur de contexte.

3. Le streaming n’arrive pas jeton par jeton. Stream: Vrai est acceptée et maintient les longues requêtes vivantes, mais le chef d’orchestre met en mémoire tampon toute l’orchestration et transmet le raisonnement ainsi que la réponse en un seul coup à la fin. Les demandes peuvent prendre de quelques secondes à quelques minutes, donc fixez des délais généreux pour les clients. Notez aussi max_tokens doit être au moins 16, et de petites valeurs peuvent tronquer ou vider la réponse.

Prix

Fugu Ultra v2.0 est payant à l’usage sans abonnement. Les entrées, sorties et entrées en cache sont en niveaux contextuels, avec un taux supérieur à 272K jetons d’entrée, et les entrées en cache sont facturées à un prix fortement réduit par rapport aux entrées ordinaires. La recherche web intégrée ne comporte pas de frais distincts sur Ultra, car son coût est déjà à l’intérieur des jetons d’orchestration. Les tarifs actuels sont sur le Page modèle Fugu Ultra v2.0 et les page de prix, qui affichent toujours le catalogue en direct.

Essaie

Lancez une invite dans le aire de jeux, ou lire la référence complète des paramètres dans le Docs API.

Prêt à utiliser de meilleurs points de terminaison ?

Explorez nos modèles, ou contactez-nous pour toute demande d’entreprise, des déploiements personnalisés ou pour tout autre sujet.