
Condutor multiagente principal para o raciocínio, codificação e pesquisa mais difíceis, com contexto de 1M, entrada de imagem e busca na web.
Condutor multiagente principal para o raciocínio, codificação e pesquisa mais difíceis, com contexto de 1M, entrada de imagem e busca na web.
Suporta entrada de texto e imagem, contexto de token de 1M, chamada de funções, saída estruturada estrita com esquema JSON e busca web embutida. O raciocínio está sempre ativado com níveis de esforço altos e xhigh; max é aceito como um pseudônimo de xhigh. A busca na web não tem taxa separada. O uso completo do token de orquestração é cobrado nas taxas de entrada, saída e cache exibidas.
Também conhecido como Fugu Ultra, Sakana AI Fugu Ultra v2.0
fugu-ultra-v2-0/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-ultra-v2-0:generateContentfugu-ultra-v2.0sakana/fugu-ultra-v2-0sakana/fugu-ultra-v2.0Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Fugu Ultra v2.0 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo fugu-ultra-v2-0. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-ultra-v2-0",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v2-0",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Fugu Ultra v2.0 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 a 131072 | Número máximo de tokens de saída para a resposta final. Deve ter pelo menos 16 anos. O condutor precisa de espaço para trabalhar, então valores muito pequenos podem... |
| reasoning_effort | enum | high | high, xhigh, max | Quão difícil é o Fugu Ultra v2.0 raciocinar. A razão está sempre ativada. O padrão é alto; xhigh e max são apelidos com o mesmo esforço máximo. |
| tool_web_search | boolean | false | - | Ative a busca web embutida. Não há taxa separada; O custo de busca é refletido nos tokens de orquestração faturados pela solicitação. |
| tools | array | [] | - | Definições de ferramentas de chamada de função compatíveis com OpenAI. |
| tool_choice | object | - | - | Controle de escolha de ferramentas compatível com OpenAI. |
| response_format | enum | - | - | Retorne saída JSON estruturada. O modo JSON retorna qualquer objeto JSON válido; O modo Esquema JSON aplica exatamente o esquema que você fornece. |
Fugu Ultra v2.0 é o condutor multiagente principal: cada requisição coordena um pool de modelos especialistas e compõe seu trabalho em uma única resposta. Latência e streaming - Respostas podem levar de alguns segundos a alguns minutos em prompts complexos. - A resposta completa é retornada de uma vez quando o modelo termina, não token por token. Streaming é aceito, mas entrega a resposta completa no final, em vez de tokens de streaming conforme eles são gerados. - max_tokens deve ter pelo menos 16. Deixe margem generosa, pois limites muito pequenos podem truncar ou esvaziar a resposta. Capacidades - Entrada de texto e imagem, com contexto de token de 1M. - Raciocínio sempre ativo. High é o padrão, Xhigh aumenta o esforço, e Max é aceito como um alias de Xhigh. - Chamada de funções, saída estruturada estrita em esquema JSON e busca web embutida que cita suas fontes quando disponível (sem taxa separada). Versionamento - Use fugu-ultra-v2-0 para a v2.0. O id legado fugu-ultra permanece fixado na v1.0 para compatibilidade retroativa, e fugu-ultra-v1-1 continua a servir a v1.1. Faturamento - Faturado com base no uso completo do token, incluindo os tokens de orquestração que o modelo usa internamente, então até prompts curtos têm algum custo. - Em camadas de contexto: requisições acima de 272K tokens totais de entrada usam a taxa maior mostrada.
Na EmpirioLabs, Fugu Ultra v2.0 é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Fugu Ultra v2.0 suporta uma janela de contexto de 1M tokens com até 131.072 tokens de saída por resposta.
Sim. Fugu Ultra v2.0 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo fugu-ultra-v2-0.
Sim. O playground da EmpirioLabs executa Fugu Ultra v2.0 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.