
하드 추론, 코딩, 연구를 위한 업데이트된 다중 에이전트 컨덕터로, 최대 노력, 1M 맥락, 이미지 입력, 웹 검색 기능을 지원합니다.
하드 추론, 코딩, 연구를 위한 업데이트된 다중 에이전트 컨덕터로, 최대 노력, 1M 맥락, 이미지 입력, 웹 검색 기능을 지원합니다.
텍스트 및 이미지 입력, 1M 토큰 컨텍스트, 함수 호출, 엄격한 JSON 스키마 구조화 출력, 내장 웹 검색 지원을 지원합니다. 추론은 항상 하이, x하이, 그리고 명확한 최대 노력으로 켜져 있습니다. 웹 검색은 별도의 비용이 없습니다. 전체 오케스트레이션 토큰 사용은 표시된 입력, 출력, 캐시 속도로 청구됩니다.
다른 이름 Fugu Ultra, Sakana AI Fugu Ultra v1.1
fugu-ultra-v1-1/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-ultra-v1-1:generateContentfugu-ultra-v1.1sakana/fugu-ultra-v1-1sakana/fugu-ultra-v1.1EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Fugu Ultra v1.1은(는) OpenAI 호환 Chat Completions API를 제공합니다. 아무 OpenAI SDK나 EmpirioLabs API 키와 함께 https://api.empiriolabs.ai/v1로 지정하고 모델 ID fugu-ultra-v1-1를 사용하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-ultra-v1-1",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v1-1",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs에서 Fugu Ultra v1.1 API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 ~ 131072 | 최종 답변을 위한 최대 출력 토큰 수. 최소 16살은 되어야 해. 도체는 작업할 공간이 필요하기 때문에 아주 작은 숫자가 답을 잘라내거나 비울 수 있습니다. |
| reasoning_effort | enum | high | high, xhigh, max | Fugu Ultra v1.1이 얼마나 강하게 이유를 내야 하는지. 이성은 항상 작동한다. High는 속도와 성능의 균형을 맞추고, xhigh는 복잡한 문제에 대한 깊은 추론을 제공하며, max는 가장 어려운 문제에 대한 뚜렷한 최대 수준입니다. |
| tool_web_search | boolean | false | - | 내장 웹 검색 기능을 활성화하세요. 별도의 수수료는 없습니다; 검색 비용은 요청에 청구되는 오케스트레이션 토큰에 반영됩니다. |
| tools | array | [] | - | OpenAI 호환 함수 호출 도구 정의. |
| tool_choice | object | - | - | OpenAI 호환 도구 선택 제어. |
| response_format | enum | - | - | 구조화된 JSON 출력을 반환합니다. JSON 모드는 유효한 JSON 객체를 반환합니다; JSON 스키마 모드는 제공하신 정확한 스키마를 강제합니다. |
Fugu Ultra v1.1은 업데이트된 다중 에이전트 컨덕터로, 각 요청은 전문가 모델 풀을 조정하고 그들의 작업을 하나의 답변으로 구성합니다. 지연 및 스트리밍 - 복잡한 프롬프트의 경우 응답이 몇 초에서 몇 분까지 걸릴 수 있습니다. - 전체 답변은 모델이 끝나면 토큰 단위가 아니라 한 번에 반환됩니다. 스트리밍은 허용되지만, 스트리밍 토큰이 생성되는 대신 전체 응답을 마지막에 전달합니다. - max_tokens 최소 16세여야 해. 아주 작은 한계가 답을 잘라내거나 비울 수 있으니 넉넉한 여유를 남겨두세요. 기능 - 텍스트 및 이미지 입력, 1M 토큰 컨텍스트. - 항상 연결된 추론, 높은 x, 그리고 가장 어려운 문제에 대해 뚜렷한 최대 수준을 적용합니다. - 함수 호출, 엄격한 JSON 스키마 구조화 출력, 출처를 명시하는 내장 웹 검색(별도 비용 없음). 버전 관리 - v1.1에서는 fugu-ultra-v1-1 사용하세요. 기존 Fugu-Ultra id는 하위 호환성을 위해 v1.0에 고정되어 있습니다. 청구** - 모델 내부에서 사용하는 오케스트레이션 토큰을 포함한 전체 토큰 사용량에 대해 청구되므로 짧은 프롬프트에도 일정 비용이 발생합니다. - 컨텍스트 계층: 총 입력 토큰 272,000개를 초과하는 요청이 표시된 더 높은 비율을 사용합니다.
EmpirioLabs에서 Fugu Ultra v1.1은(는) 종량제로 청구됩니다. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Fugu Ultra v1.1은(는) 1M 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 131,072 출력 토큰).
네. Fugu Ultra v1.1은(는) OpenAI 호환 Chat Completions API를 제공하므로, 기존 OpenAI SDK에서 base_url을 https://api.empiriolabs.ai/v1로 지정하고 모델 ID를 fugu-ultra-v1-1로 설정하면 바로 동작합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Fugu Ultra v1.1을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.