Fugu Ultra v2.0はEmpirioLabsで利用可能です。 Fuguは単一のモデルではありません。それは導体であり、1つのAPIがリクエストを専門家モデルのプールに呼び出し、それらの作業を単一の回答にまとめます。Ultraはそのファミリーの旗艦であり、v2.0は自律推論、研究、ソフトウェア開発など複雑で多段階の作業においてピークの能力を発揮できるように調整されています。
Fugu Ultra v2.0がサポートしていること
Fugu Ultra v2.0は、1Mトークンコンテキストウィンドウでテキストと画像の入力を受け付けます。関数呼び出し、厳格なJSONスキーマ構造化出力、そして利用可能なソースを提示する組み込みのウェブ検索をサポートしています。推論は常にオンで、出力は1リクエストあたり131,072トークンに制限されています。
Fugu Ultra v2.0の呼び方
OpenAI互換のチャット完了エンドポイントを使い、設定してください モデル から fugu-ultra-v2-0:
curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Authorization: Bearer $EMPIRIOLABS_API_KEY' \ -H 'Content-Type: application/json' \ -d '{ "model": "fugu-ultra-v2-0", "reasoning_effort": "xhigh", "messages": [ { "role": "user", "content": "忙しい書き込み負荷の高いサービスを新しいデータベースに移す移行計画を設計し、何が問題になるかをフラグ付けする。" } ] }'
同じモデルはResponses、Messages、Google互換コンテンツ生成エンドポイントを通じて利用可能です。導体が推論要約を返すと、次のように表示されます。 message.reasoning_content 答えとともに。
v1.0またはv1.1からの移行
バージョンIDは明示的で固定されているため、あなたの下では何も動かされません。 fugu-ultra-v1-0 および fugu-ultra-v1-1 自分たちのスナップショットと遺産を提供し続けてください フグウルトラ idはv1.0に固定されたままです。v2.0への切り替えは1行の変更です。
移行前に確認すべき実際の挙動の違いの一つ:v1.1 treatsです マックス より上の明確な最大推論レベルとして xhigh.v2.0では、 マックス は の別名として受け入れられています。 xhigh.意図的にv1.1に到達したコード マックス v2.0でも動作しますが、今は同じ処理処理を選択します。 xhighお問い合わせ.
電話が間違える三つのポイント
1. トークンの数があなたのプロンプトよりも多い。 導体が他のモデルにファンアウトするのは実際のトークン使用であり、通常の入力・出力トークンとして表記されます。ウェブ検索を有効にした短いプロンプトで、6桁の入力トークン数を報告できます。返送されたものに対する予算 使用例 自分のメッセージの長さではなく、ブロックしてください。
2. コンテキストの階層は、請求された入力によって決定され、プロンプトによって決定されるわけではありません。 Fugu Ultra v2.0は272K入力トークン以上のレートが高く、その閾値はオーケストレーションを含む全請求入力で測定されます。したがって、控えめなプロンプトでも重いリクエストで上位ティアに到達する可能性があります。ピークの能力よりもティアの安定性が重要なら、Fugu Maxはコンテキスト長ごとに1つの固定レートがあります。
3. ストリーミングはトークンバイトークンで到達しません。 ストリーム:True は受け入れられ、長いリクエストを保持しますが、コンダクターはオーケストレーション全体をバッファリングし、最後に一度のバーストで理由と回答を伝えます。リクエストは数秒から数分かかることがあるため、クライアントのタイムアウトは寛大に設定してください。また注意 max_tokens 16以上でなければならず、小さな値は答えを切り捨てたり空にしたりします。
料金について
Fugu Ultra v2.0はサブスクリプション不要の課金制です。入力、出力、キャッシュ入力はコンテキスト階層化されており、272Kの入力トークンを超えるレートが高く、キャッシュ入力は通常の入力よりも大幅に割引で請求されます。Ultraでは組み込みのウェブ検索機能が別料金を請求しません。なぜなら、そのコストはすでにオーケストレーショントークン内に内包されているからです。現在の料金は Fugu Ultra v2.0モデルページ そして、 プライシングページ、これらは常にライブカタログをレンダリングします。
試してみて
プロンプトを プレイグラウンドまたは、パラメータ参照の全文を読み取るか、 API ドキュメントお問い合わせ.



