Fugu Ultra v1.1 está disponível no EmpirioLabs. É o condutor multiagente atualizado da Sakana AI para tarefas difíceis de raciocínio, codificação e pesquisa. Uma solicitação coordena um grupo mais profundo de agentes especialistas e retorna o trabalho combinado como uma única resposta.
O que mudou na versão 1.1
Fugu Ultra v1.1 adiciona um diferencial distinto max Nível de raciocínio para os problemas mais difíceis. O alto o nível equilibra velocidade e desempenho, xhigh fornece raciocínio profundo para problemas complexos, e max é o nível máximo distinto. A razão permanece sempre ativa.
Os IDs de versão são explícitos no EmpirioLabs. Uso fugu-ultra-v1-1 para o novo modelo e fugu-ultra-v1-0 para o lançamento original. Integrações existentes que enviam fugu-ultra Permanecer fixado na v1.0, então adotar a v1.1 é uma mudança intencional do modelo, e não uma atualização silenciosa.
Como chamar o Fugu Ultra v1.1
Use o endpoint de conclusão de chat compatível com OpenAI e configure modelo para fugu-ultra-v1-1:
curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorização: Portador $EMPIRIOLABS_API_KEY' \ -H 'Tipo-Conteúdo: application/json' \ -d '{ "modelo": "fugu-ultra-v1-1", "reasoning_effort": "max", "max_tokens": 4096, "mensagens": [ { "função": "usuário", "conteúdo": "Projete um plano de migração para uma API multi-região sem tempo de inatividade." } ] }'
O mesmo modelo também funciona através dos endpoints de geração de conteúdo compatíveis com o Google, Respostas, Mensagens e Respostas. Os limites de saída devem ser de pelo menos 16 tokens, e prompts complexos se beneficiam de tempos de espera generosos para o cliente.
Capacidades para construir com
O Fugu Ultra v1.1 aceita entrada de texto e imagem dentro de uma janela de contexto de token de 1M. Ele suporta chamada de funções, saída estruturada estrita em esquema JSON e busca web integrada. A busca na web pode citar fontes quando a resposta as fornece.
O modelo realiza a orquestração antes de responder, então as solicitações podem levar de alguns segundos a alguns minutos. As requisições de streaming permanecem abertas, mas a resposta é entregue quando a orquestração termina, em vez de token por token.
Preços e faturamento
O Fugu Ultra v1.1 usa precificação de tokens pay-as-you-go em nível de contexto com entrada em cache descontada. A faturação inclui o prompt, a resposta final e os tokens de orquestração usados pelo pool de agentes especialistas. Contextos maiores usam o nível de contexto mais alto. Assista ao vivo Página do modelo Fugu Ultra v1.1 e página de preços Para as taxas atuais.
Comece a construir
Experimente o Fugu Ultra v1.1 no Área de reprodução, ler Documentação da API, ou compare ambas as versões no Catálogo de modelos.
Divulgação: Este artigo foi escrito com assistência de IA e revisado por EmpirioLabs IA.



