
Condutor multiagente atualizado para raciocínio rigoroso, codificação e pesquisa, com esforço máximo distinto, contexto 1M, entrada de imagem e busca na web.
Condutor multiagente atualizado para raciocínio rigoroso, codificação e pesquisa, com esforço máximo distinto, contexto 1M, entrada de imagem e busca na web.
Suporta entrada de texto e imagem, contexto de token de 1M, chamada de funções, saída estruturada estrita com esquema JSON e busca web integrada. O raciocínio está sempre ativo com alto, xhigh e um esforço máximo distinto. A busca na web não tem taxa separada. O uso completo de tokens de orquestração é cobrado nas taxas de entrada, saída e cache exibidas.
Também conhecido como Fugu Ultra, Sakana AI Fugu Ultra v1.1
fugu-ultra-v1-1/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-ultra-v1-1:generateContentfugu-ultra-v1.1sakana/fugu-ultra-v1-1sakana/fugu-ultra-v1.1Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Fugu Ultra v1.1 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo fugu-ultra-v1-1. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-ultra-v1-1",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v1-1",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Fugu Ultra v1.1 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 a 131072 | Número máximo de tokens de saída para a resposta final. Deve ter pelo menos 16 anos. O condutor precisa de espaço para trabalhar, então valores muito pequenos podem... |
| reasoning_effort | enum | high | high, xhigh, max | O quão difícil é o Fugu Ultra v1.1 raciocinar. A razão está sempre ativa. O High equilibra velocidade e desempenho, o Xhigh fornece raciocínio profundo para... |
| tool_web_search | boolean | false | - | Ative a busca web embutida. Não há taxa separada; O custo de busca é refletido nos tokens de orquestração faturados pela solicitação. |
| tools | array | [] | - | Definições de ferramentas de chamada de função compatíveis com OpenAI. |
| tool_choice | object | - | - | Controle de escolha de ferramentas compatível com OpenAI. |
| response_format | enum | - | - | Retorne saída JSON estruturada. O modo JSON retorna qualquer objeto JSON válido; O modo Esquema JSON aplica exatamente o esquema que você fornece. |
Fugu Ultra v1.1 é um condutor multiagente atualizado: cada solicitação coordena um conjunto de modelos especialistas e compõe seu trabalho em uma única resposta. Latência e streaming - As respostas podem levar de alguns segundos a alguns minutos em prompts complexos. - A resposta completa é retornada de uma vez quando o modelo termina, não token por token. O streaming é aceito, mas entrega a resposta completa no final, em vez de transmitir tokens conforme eles são gerados. - max_tokens deve ter pelo menos 16 anos. Deixe uma margem generosa, pois limites muito pequenos podem truncar ou esvaziar a resposta. Capacidades - Entrada de texto e imagem, com contexto de token de 1M. - Raciocínio sempre ativo com alto, xhigh e um nível máximo distinto para os problemas mais difíceis. - Chamada de funções, saída estruturada estrita em esquema JSON e busca web embutida que cita suas fontes quando disponíveis (sem taxa separada). Versionamento - Use fugu-ultra-v1-1 para a v1.1. O id legado fugu-ultra permanece fixado na v1.0 para compatibilidade retroativa. Faturamento - Faturado com base no uso completo do token, incluindo os tokens de orquestração que o modelo usa internamente, então até prompts curtos têm algum custo. - Em níveis de contexto: solicitações acima de 272K tokens totais de entrada usam a taxa maior mostrada.
Na EmpirioLabs, Fugu Ultra v1.1 é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Fugu Ultra v1.1 suporta uma janela de contexto de 1M tokens com até 131.072 tokens de saída por resposta.
Sim. Fugu Ultra v1.1 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo fugu-ultra-v1-1.
Sim. O playground da EmpirioLabs executa Fugu Ultra v1.1 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.