更新的多智能体指挥器,用于硬推理、编码和研究,具备独特的最大努力、100万上下文、图像输入和网页搜索。
支持文本和图片输入、100万令牌上下文、函数调用、严格的JSON模式结构化输出以及内置网页搜索。推理始终开启,使用高、x高和不同的最大努力。网页搜索无需单独收费。完整的编排令牌使用按显示的输入、输出和缓存速率计费。
也称为 Fugu Ultra, Sakana AI Fugu Ultra v1.1
fugu-ultra-v1-1/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-ultra-v1-1:generateContentfugu-ultra-v1.1sakana/fugu-ultra-v1-1sakana/fugu-ultra-v1.1来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Fugu Ultra v1.1 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID fugu-ultra-v1-1。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-ultra-v1-1",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v1-1",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上 Fugu Ultra v1.1 API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 到 131072 | 最终答案的最大输出标记数。必须至少16个。导体需要工作空间,因此非常小的值可能会截断或清空答案。 |
| reasoning_effort | enum | high | high, xhigh, max | Fugu Ultra v1.1 推理有多难。推理始终开启。高能平衡速度和性能,XHigh 为复杂问题提供深度推理,最高难度是最高难题的最高等级。 |
| tool_web_search | boolean | false | - | 启用内置网页搜索功能。无需单独收费;搜索费用反映在请求收费的编排令牌中。 |
| tools | array | [] | - | 兼容 OpenAI 的函数调用工具定义。 |
| tool_choice | object | - | - | 兼容OpenAI的工具选择控制。 |
| response_format | enum | - | - | 返回结构化JSON输出。JSON模式返回任何有效的JSON对象;JSON模式强制执行你提供的精确模式。 |
Fugu Ultra v1.1 是一个更新的多智能体指挥器:每个请求协调一个专家模型池,并将他们的工作组合成一个单一答案。延迟与流式传输 - 复杂提示时响应时间从几秒到几分钟不等。- 模型完成时一次性返回完整答案,而非逐令牌计算。接受流式,但最终交付完整响应,而非流式令牌生成。- max_tokens必须至少为16。留有充足的余量,因为极小的限制可能会截断或清空答案。能力- 文本和图像输入,包含100万令牌上下文。- 始终在线推理,高、x高,以及针对最难问题的明确最大等级。- 函数调用,严格的JSON模式结构化输出,以及内置网页搜索,在有来源时引用(无额外费用)。版本管理 - v1.1 使用fugu-ultra-v1-1。遗留的 fugu-ultra id 仍钉在 v1.0 以保证向后兼容。计费 - 按完整令牌使用计费,包括模型内部使用的编排令牌,因此即使是短提示也会有一定成本。- 上下文分级:请求总输入令牌超过 27.2 万次时,使用显示的更高速率。
在 EmpirioLabs,Fugu Ultra v1.1 按量计费。本页的实时价格表始终与 API 的实际计费一致。
Fugu Ultra v1.1 支持 1M token 的上下文窗口,每次响应最多 131,072 个输出 token。
兼容。Fugu Ultra v1.1 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 fugu-ultra-v1-1 即可使用。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Fugu Ultra v1.1,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。