
Conductor multiagente insignia para el razonamiento, la codificación y el trabajo de investigación más difíciles, con 1M de contexto, entrada de imagen y búsqueda web.
Conductor multiagente insignia para el razonamiento, la codificación y el trabajo de investigación más difíciles, con 1M de contexto, entrada de imagen y búsqueda web.
Soporta entrada de texto e imagen, un contexto de token de 1M, llamada a funciones, salida estructurada estricta en esquema JSON y búsqueda web integrada. El razonamiento siempre está activo con niveles de esfuerzo altos y xhigh; max se acepta como alias de xhigh. La búsqueda web no tiene una tarifa separada. El uso completo de tokens de orquestación se factura a las tasas de entrada, salida y caché mostradas.
También conocido como Fugu Ultra, Sakana AI Fugu Ultra v2.0
fugu-ultra-v2-0/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-ultra-v2-0:generateContentfugu-ultra-v2.0sakana/fugu-ultra-v2-0sakana/fugu-ultra-v2.0Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
Fugu Ultra v2.0 sirve la API de Chat Completions compatible con OpenAI. Apunta cualquier SDK de OpenAI a https://api.empiriolabs.ai/v1 con tu clave de API de EmpirioLabs y usa el id de modelo fugu-ultra-v2-0. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-ultra-v2-0",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v2-0",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parámetros de solicitud compatibles con la API de Fugu Ultra v2.0 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 a 131072 | Número máximo de tokens de salida para la respuesta final. Debe de tener al menos 16 años. El conductor necesita espacio para trabajar, por lo que valores muy... |
| reasoning_effort | enum | high | high, xhigh, max | Qué difícil es Fugu Ultra v2.0. El razonamiento siempre está activado. El valor por defecto es alto; xhigh y max son alias con el mismo esfuerzo máximo. |
| tool_web_search | boolean | false | - | Activa la búsqueda web integrada. No hay una tarifa separada; El coste de búsqueda se refleja en los tokens de orquestación facturados por la petición. |
| tools | array | [] | - | Definiciones de herramientas de llamada a funciones compatibles con OpenAI. |
| tool_choice | object | - | - | Control de elección de herramientas compatible con OpenAI. |
| response_format | enum | - | - | Devuelve la salida JSON estructurada. El modo JSON devuelve cualquier objeto JSON válido; El modo esquema JSON aplica exactamente el esquema que proporcionas. |
Fugu Ultra v2.0 es el conductor multiagente insignia: cada solicitud coordina un conjunto de modelos expertos y compone su trabajo en una sola respuesta. Latencia y streaming - Las respuestas pueden tardar desde unos segundos hasta unos minutos en prompts complejos. - La respuesta completa se devuelve de golpe cuando termina el modelo, no token por token. Se acepta el streaming, pero ofrece la respuesta completa al final en lugar de streaming tokens a medida que se generan. - max_tokens debe tener al menos 16. Deja un margen generoso, ya que límites muy pequeños pueden truncar o vaciar la respuesta. Capacidades - Entrada de texto e imagen, con un contexto de token de 1M. - Razonamiento siempre activo. High es el predeterminado, Xhigh aumenta el esfuerzo y Max se acepta como alias de Xhigh. - Llamada a funciones, salida estructurada estricta en esquema JSON y búsqueda web integrada que cita sus fuentes cuando está disponible (sin comisión separada). Versionado - Usa fugu-ultra-v2-0 para la v2.0. El id fugu-ultra heredado permanece fijado a la v1.0 para compatibilidad hacia atrás, y fugu-ultra-v1-1 sigue sirviendo a la v1.1. Facturación - Facturado en el uso completo de tokens, incluyendo los tokens de orquestación que el modelo usa internamente, por lo que incluso los prompts cortos tienen cierto coste. - Contextualizado: las solicitudes por encima de 272K tokens de entrada totales usan la tasa más alta mostrada.
En EmpirioLabs, Fugu Ultra v2.0 se factura por uso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
Fugu Ultra v2.0 admite una ventana de contexto de 1M tokens con hasta 131.072 tokens de salida por respuesta.
Sí. Fugu Ultra v2.0 sirve la API de Chat Completions compatible con OpenAI, así que los SDKs de OpenAI existentes funcionan apuntando base_url a https://api.empiriolabs.ai/v1 y usando el id de modelo fugu-ultra-v2-0.
Sí. El playground de EmpirioLabs ejecuta Fugu Ultra v2.0 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.