Fugu Ultra API

Maestro multiagente que orquestra modelos especialistas de vanguarda para raciocínio rigoroso, codificação e pesquisa, com contexto 1M, entrada de imagem e busca na web.

Sakana AIGeração de Texto1M contextoLançado Jun 21, 2026Endpoint proprietárioNovo

About Fugu Ultra

Maestro multiagente que orquestra modelos especialistas de vanguarda para raciocínio rigoroso, codificação e pesquisa, com contexto 1M, entrada de imagem e busca na web.

Suporta entrada de texto e imagem, contexto de token de 1M, chamada de funções, saída estruturada em modo JSON e busca web embutida. O raciocínio está sempre ativo com níveis de esforço altos, xaltos e máximos (xhigh e max aplicam mais esforço). A busca na web não tem taxa separada; seu custo se reflete nos tokens de orquestração que o maestro relata em uso. Os tokens de orquestração são cobrados nas mesmas taxas de entrada e saída que seu prompt e resposta final, então mesmo requisições curtas incluem custo de orquestração.

Também conhecido como Sakana AI Fugu Ultra, Fugu-Ultra

reasoningmultimodalweb searchfunction callingstructured outputagentic codingcache

Fugu Ultra specs

ID do modelo
fugu-ultra
Provedor
Sakana AI
Categoria
Geração de Texto
Released
Jun 21, 2026
Janela de contexto
1M tokens
Saída máxima
131,072 tokens
Entrada
TextImage
Saída
Text
Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages

Fugu Ultra API pricing

Live pay-as-you-go rates from the EmpirioLabs catalog. You are billed only for what you use, with no monthly minimum.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
<=272K $7.50>272K $15.00
Saída
por tokens gerados 1M
<=272K $45.00>272K $67.50
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
<=272K $1.50>272K $3.00
Comparar na página completa de preços

How to call the Fugu Ultra API

Fugu Ultra serves the OpenAI-compatible Chat Completions API. Point any OpenAI SDK at https://api.empiriolabs.ai/v1 with your EmpirioLabs API key and use the model id fugu-ultra. Get an API key from the EmpirioLabs dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "fugu-ultra",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="fugu-ultra",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Full Fugu Ultra API reference

Fugu Ultra API parameters

Request parameters supported by the Fugu Ultra API on EmpirioLabs. Defaults apply when a field is omitted.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
max_tokensinteger327681 to 131072Maximum number of output tokens for the final answer. The conductor needs room to work, so very small values can return empty output.
reasoning_effortenumhighhigh, xhigh, maxHow hard Fugu Ultra reasons. Reasoning is always on. The default is high; xhigh and max are aliases of the same maximum effort (more thorough and slower than high).
tool_web_searchbooleanfalse-Enable built-in web search. There is no separate fee; the search cost is reflected in the orchestration tokens billed for the request.
toolsarray[]-OpenAI-compatible function calling tool definitions.
tool_choiceobject--OpenAI-compatible tool choice control.
response_formatobject--OpenAI-compatible JSON mode for structured output.

Bom saber

Fugu Ultra é um maestro multi-agente: cada solicitação coordena um conjunto de modelos especialistas e compõe seu trabalho em uma única resposta. Latência e streaming - As respostas podem levar de alguns segundos a alguns minutos em prompts complexos. - A resposta completa é retornada de uma vez quando o modelo termina, não token por token. O streaming é aceito, mas entrega a resposta completa no final, em vez de transmitir tokens conforme eles são gerados. - Deixe um espaço generoso max_tokens, pois limites muito pequenos podem truncar ou esvaziar a resposta. Capacidades - Entrada de texto e imagem, com contexto de token de 1M. - Raciocínio sempre ativo. alto é o padrão; Xhigh e Max têm o mesmo esforço máximo. - Chamada de funções, modo JSON e busca web embutida que cita suas fontes quando disponível (sem taxa separada). Faturamento - Faturado com base no uso completo do token, incluindo os tokens de orquestração que o modelo usa internamente, então até prompts curtos têm algum custo. - Em níveis de contexto: solicitações acima de 272K tokens totais de entrada usam a taxa maior mostrada.

Fugu Ultra API: common questions

How much does the Fugu Ultra API cost?

On EmpirioLabs, Fugu Ultra is billed pay as you go: Entrada <=272K $7.50; >272K $15.00 por fichas de alerta de 1M; Saída <=272K $45.00; >272K $67.50 por tokens gerados 1M; Leu a 'cache' implícita <=272K $1.50; >272K $3.00 por fichas de entrada em cache de 1M. The live rate card on this page always matches what the API charges.

What is the context window of Fugu Ultra?

Fugu Ultra supports a 1M-token context window with up to 131,072 output tokens per response.

Is the Fugu Ultra API OpenAI-compatible?

Yes. Fugu Ultra serves the OpenAI-compatible Chat Completions API, so existing OpenAI SDKs work by pointing base_url at https://api.empiriolabs.ai/v1 and setting the model id to fugu-ultra.

Can I try Fugu Ultra in the browser before integrating?

Yes. The EmpirioLabs playground runs Fugu Ultra in the browser with the same parameters the API exposes, so you can test prompts before writing code.

How do I get a Fugu Ultra API key?

Create an EmpirioLabs account, then generate a key under API Keys in the dashboard. Billing is pay-as-you-go credits, so you only pay for the requests you make.

Ready to use better endpoints?

Check out our pricing or reach out if you want your own model deployed on our stack.