
Condutor multiagente econômico que reúne uma equipe de especialistas do tamanho certo por tarefa, com 1M de contexto, entrada de imagem e busca na web.
Condutor multiagente econômico que reúne uma equipe de especialistas do tamanho certo por tarefa, com 1M de contexto, entrada de imagem e busca na web.
Suporta entrada de texto e imagem, contexto de token de 1M, chamada de funções, saída estruturada estrita em esquema JSON e busca web embutida. O raciocínio está sempre ativado com níveis de esforço altos e xhigh; max é aceito como um alias de xhigh. Uma taxa fixa de token para cada comprimento de contexto. Busca web embutida e fatura de busca de página por chamada executada. O uso completo do token de orquestração é faturado nas taxas de entrada, saída e cache exibidas.
Também conhecido como Sakana AI Fugu Max
fugu-max/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-max:generateContentfugu-max-v1.0sakana/fugu-maxsakana/fugu-max-v1.0Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Fugu Max atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo fugu-max. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-max",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-max",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Fugu Max na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 a 131072 | Número máximo de tokens de saída para a resposta final. Deve ter pelo menos 16 anos. O condutor precisa de espaço para trabalhar, então valores muito pequenos podem... |
| reasoning_effort | enum | high | high, xhigh, max | Como o Fugu Max raciocina com dificuldade. O raciocínio está sempre ativado. O padrão é alto; xhigh e max são aliases do mesmo esforço máximo. |
| tool_web_search | boolean | false | - | Ative a busca web embutida. Adiciona $0.007 ao custo da solicitação para cada chamada invocada, e uma única requisição pode rodar mais de uma chamada. As buscas de... |
| tools | array | [] | - | Definições de ferramentas de chamada de função compatíveis com OpenAI. |
| tool_choice | object | - | - | Controle de escolha de ferramentas compatível com OpenAI. |
| response_format | enum | - | - | Retorne saída JSON estruturada. O modo JSON retorna qualquer objeto JSON válido; O modo Esquema JSON aplica exatamente o esquema que você fornece. |
Fugu Max é o condutor multiagente econômico: cada requisição reúne uma equipe de modelos especialistas do tamanho certo para a tarefa e compõe seu trabalho em uma única resposta. Latência e streaming - Prompts simples geralmente retornam em alguns segundos, e prompts mais pesados demoram mais enquanto o condutor trabalha. - A resposta completa é retornada de uma vez quando o modelo termina, não token por token. Streaming é aceito, mas entrega a resposta completa no final, em vez de tokens de streaming conforme eles são gerados. - max_tokens deve ter pelo menos 16. Deixe margem generosa, pois limites muito pequenos podem truncar ou esvaziar a resposta. Capacidades - Entrada de texto e imagem, com contexto de token de 1M. - Raciocínio sempre ativo. High é o padrão, Xhigh aumenta o esforço, e Max é aceito como um alias de Xhigh. - Chamada de funções, saída estruturada de esquema JSON rigoroso e busca web embutida que cita suas fontes quando disponíveis. Faturamento - Faturado com base no uso total do token, incluindo os tokens de orquestração que o modelo usa internamente, então até prompts curtos têm algum custo. - Uma taxa fixa de token em cada comprimento de contexto, sem taxa maior para prompts longos. - Busca web e busca de página integradas são faturadas por chamada executada nas taxas mostradas, e uma única requisição pode executar mais de uma chamada.
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
Na EmpirioLabs, Fugu Max é cobrado por uso: Entrada $2.00 por 1M de tokens de prompt; Saída $6.00 por 1M de tokens gerados; Leitura implícita do cache $0.25 por 1M de tokens de entrada cacheados. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Fugu Max suporta uma janela de contexto de 1M tokens com até 131.072 tokens de saída por resposta.
Sim. Fugu Max atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo fugu-max.
Sim. O playground da EmpirioLabs executa Fugu Max no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.