Fugu Max API

Condutor multiagente econômico que reúne uma equipe de especialistas do tamanho certo por tarefa, com 1M de contexto, entrada de imagem e busca na web.

Sakana AIGeração de Texto1M contextoLançado 10 de set. de 2026Endpoint proprietárioNovo

Sobre Fugu Max

Condutor multiagente econômico que reúne uma equipe de especialistas do tamanho certo por tarefa, com 1M de contexto, entrada de imagem e busca na web.

Suporta entrada de texto e imagem, contexto de token de 1M, chamada de funções, saída estruturada estrita em esquema JSON e busca web embutida. O raciocínio está sempre ativado com níveis de esforço altos e xhigh; max é aceito como um alias de xhigh. Uma taxa fixa de token para cada comprimento de contexto. Busca web embutida e fatura de busca de página por chamada executada. O uso completo do token de orquestração é faturado nas taxas de entrada, saída e cache exibidas.

Também conhecido como Sakana AI Fugu Max

reasoningmultimodalweb searchfunction callingagentic codingstructured outputcache

Especificações de Fugu Max

ID do modelo
fugu-max
Autor
Sakana AI
Categoria
Geração de Texto
Lançado
10 de set. de 2026
Janela de contexto
1M tokens
Saída máxima
131.072 tokens
Entrada
TextoImagem
Saída
Texto
Saída estruturada
JSON Schema
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-max:generateContent
IDs de modelo alternativos
fugu-max-v1.0sakana/fugu-maxsakana/fugu-max-v1.0

Preços da API Fugu Max

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$2.00
Saída
por 1M de tokens gerados
$6.00
Leitura implícita do cache
por 1M de tokens de entrada cacheados
$0.25
Pesquisa Web
por chamada quando invocada
$0.007
Extrator de teia
por chamada quando invocada
$0.007
Comparar na página completa de preços

Como chamar a API Fugu Max

Fugu Max atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo fugu-max. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "fugu-max",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="fugu-max",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referência completa da API Fugu Max

Parâmetros da API Fugu Max

Parâmetros de requisição suportados pela API Fugu Max na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
max_tokensinteger3276816 a 131072Número máximo de tokens de saída para a resposta final. Deve ter pelo menos 16 anos. O condutor precisa de espaço para trabalhar, então valores muito pequenos podem...
reasoning_effortenumhighhigh, xhigh, maxComo o Fugu Max raciocina com dificuldade. O raciocínio está sempre ativado. O padrão é alto; xhigh e max são aliases do mesmo esforço máximo.
tool_web_searchbooleanfalse-Ative a busca web embutida. Adiciona $0.007 ao custo da solicitação para cada chamada invocada, e uma única requisição pode rodar mais de uma chamada. As buscas de...
toolsarray[]-Definições de ferramentas de chamada de função compatíveis com OpenAI.
tool_choiceobject--Controle de escolha de ferramentas compatível com OpenAI.
response_formatenum--Retorne saída JSON estruturada. O modo JSON retorna qualquer objeto JSON válido; O modo Esquema JSON aplica exatamente o esquema que você fornece.

Bom saber

Fugu Max é o condutor multiagente econômico: cada requisição reúne uma equipe de modelos especialistas do tamanho certo para a tarefa e compõe seu trabalho em uma única resposta. Latência e streaming - Prompts simples geralmente retornam em alguns segundos, e prompts mais pesados demoram mais enquanto o condutor trabalha. - A resposta completa é retornada de uma vez quando o modelo termina, não token por token. Streaming é aceito, mas entrega a resposta completa no final, em vez de tokens de streaming conforme eles são gerados. - max_tokens deve ter pelo menos 16. Deixe margem generosa, pois limites muito pequenos podem truncar ou esvaziar a resposta. Capacidades - Entrada de texto e imagem, com contexto de token de 1M. - Raciocínio sempre ativo. High é o padrão, Xhigh aumenta o esforço, e Max é aceito como um alias de Xhigh. - Chamada de funções, saída estruturada de esquema JSON rigoroso e busca web embutida que cita suas fontes quando disponíveis. Faturamento - Faturado com base no uso total do token, incluindo os tokens de orquestração que o modelo usa internamente, então até prompts curtos têm algum custo. - Uma taxa fixa de token em cada comprimento de contexto, sem taxa maior para prompts longos. - Busca web e busca de página integradas são faturadas por chamada executada nas taxas mostradas, e uma única requisição pode executar mais de uma chamada.

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

API Fugu Max: perguntas frequentes

Quanto custa a API Fugu Max?

Na EmpirioLabs, Fugu Max é cobrado por uso: Entrada $2.00 por 1M de tokens de prompt; Saída $6.00 por 1M de tokens gerados; Leitura implícita do cache $0.25 por 1M de tokens de entrada cacheados. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual é a janela de contexto de Fugu Max?

Fugu Max suporta uma janela de contexto de 1M tokens com até 131.072 tokens de saída por resposta.

A API Fugu Max é compatível com OpenAI?

Sim. Fugu Max atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo fugu-max.

Posso testar Fugu Max no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa Fugu Max no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API Fugu Max?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.