首页 博客

如何使用Fugu Ultra v2.0 API

如何使用Fugu Ultra v2.0 API

Sep 11, 2026

EmpirioLabs AI

Fugu Ultra v2.0 已在EmpirioLabs平台上线。 Fugu 不是单一模型。它是一个导体:一个 API 调用将请求发送到多个专家模型池中,并将他们的工作整合成一个统一的答案。Ultra 是该家族的旗舰产品,v2.0 则针对自主推理、研究和软件开发等复杂多步工作进行最高能力调校。

Fugu Ultra v2.0 支持的内容

Fugu Ultra v2.0 接受文本和图像输入,使用100万令牌上下文窗口。它支持函数调用、严格的 JSON Schema 结构化输出,以及内置的网页搜索,并在来源可用时提供引用。推理功能始终开启,输出上限为每个请求 131,072 个令牌。

如何称呼Fugu Ultra v2.0

使用兼容 OpenAI 的聊天完成终端并设置 模型 到 fugu-ultra-v2-0编号:

curl https://api.empiriolabs.ai/v1/chat/completions \ -h '授权:承载者 $EMPIRIOLABS_API_KEY' \ -h '内容类型:application/json' \ -d '{ “model”: “fugu-ultra-v2-0”, “reasoning_effort”: “xhigh”, “messages”: [ { “role”: “user”, “content”: “设计迁移计划,将繁忙的写入服务迁移到新数据库,并标记可能出现的问题。” } ] }'

同样的模型也可以通过响应、消息和兼容谷歌的内容生成端点获得。当导体返回推理摘要时,结果为 message.reasoning_content 同时也在回答中。

从v1.0或v1.1迁移

版本ID是显式且固定的,所以你下面不会有任何移动。 fugu-ultra-v1-0 以及 fugu-ultra-v1-1 继续提供他们自己的快照和遗产 Fugu-Ultra id 仍然固定在 v1.0。切换到 v2.0 只需一行切换。

迁移前需要检查的一个真正的行为差异:v1.1 treats 最大数 作为一个明确的最大推理层级,高于此 高.在2.0版本中, 最大数 被接受为 的别名 高.这些代码是故意针对v1.1的 最大数 仍会运行在 v2.0 版本上,但现在选择的 Effort 与 高。 。 。.

来电者会犯错的三件事

1. 代币数量比你的提示词还多。 指挥向其他型号的扇化为真实的令牌使用,计费为普通输入和输出令牌。启用网页搜索的简短提示可报告六位数输入令牌数。与返回的对比 用途 而是封锁,而不是你自己消息的长度。

2. 上下文层级由计费输入决定,而不是你的提示。 Fugu Ultra v2.0在272K输入令牌以上的速率更高,这个阈值是通过包含编排的全额计费输入来衡量的。所以一个普通的提示在重负载请求中仍然可能进入更高层级。如果你更看重层级稳定性而非峰值能力,Fugu Max在每个上下文长度下都有一个固定速率。

3. 流媒体不是通过令牌到达。 流媒体:真实 被接受并保持长请求存活,但指挥会缓冲整个编曲,并在结尾一次性传递推理和答案。请求可能需要几秒钟到几分钟,因此应设定宽松的客户端超时。另请注意 max_tokens 必须至少是16,且小值可以截断或清空答案。

定价

Fugu Ultra 2.0 是按需付费,无需订阅。输入、输出和缓存输入按上下文分层处理,超过272K输入代币的速率更高,缓存输入的收费率远低于普通输入。内置网页搜索在Ultra上没有额外费用,因为其成本已包含在编排代币中。当前速率在 Fugu Ultra v2.0 型号页面 页:1 定价页面,这些总是实时目录。

试试看吧

在 操场,或者读取完整的参数引用 API 文档。 。 。.

准备好使用更好的终端了吗?

欢迎浏览我们的模型,或联系我们洽谈业务咨询、定制部署或其他任何事宜。