
موصل متعدد الوكلاء وفعال من حيث التكلفة يجمع فريقا خبراء بالحجم المناسب لكل مهمة، مع 1 مليون سياق، وإدخال صور، وبحث على الويب.
موصل متعدد الوكلاء وفعال من حيث التكلفة يجمع فريقا خبراء بالحجم المناسب لكل مهمة، مع 1 مليون سياق، وإدخال صور، وبحث على الويب.
يدعم إدخال النصوص والصور، وسياق رمز بقيمة 1M، واستدعاء الدوال، ومخرجات منظمة صارمة لمخطط JSON، وبحث ويب مدمج. الاستدلال دائما مفعل مع مستويات الجهد عالية وxhigh؛ يتم قبول max كاسم مستعار ل xhigh. معدل رمز ثابت واحد عند كل طول سياق. بحث ويب مدمج وفاتورة جلب الصفحة لكل استدعاء تم تنفيذه. يتم احتساب الاستخدام الكامل لرموز التنسيق بناء على معدلات الإدخال والإخراج والكاش المعروضة.
يعرف أيضا باسم Sakana AI Fugu Max
fugu-max/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/fugu-max:generateContentfugu-max-v1.0sakana/fugu-maxsakana/fugu-max-v1.0أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يقدم Fugu Max واجهة Chat Completions المتوافقة مع OpenAI. وجّه أي OpenAI SDK إلى https://api.empiriolabs.ai/v1 بمفتاح EmpirioLabs API الخاص بك واستخدم معرّف النموذج fugu-max. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fugu-max",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="fugu-max",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)معلمات الطلب التي تدعمها واجهة Fugu Max API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| max_tokens | integer | 32768 | 16 إلى 131072 | الحد الأقصى لعدد رموز الإخراج للإجابة النهائية. يجب أن يكون على الأقل 16. يحتاج الموصل إلى مساحة للعمل، لذا يمكن للقيم الصغيرة جدا أن تقطع أو تفرغ الإجابة. |
| reasoning_effort | enum | high | high, xhigh, max | مدى صعوبة تفكير فوغو ماكس. المنطق دائما مفعل. الافتراضي هو عالي؛ xhigh وmax هما أسماء مستعارة لنفس الحد الأقصى للجهد. |
| tool_web_search | boolean | false | - | تمكين البحث المدمج على الويب. يضيف $0.007 إلى تكلفة الطلب لكل استدعاء يتم استدعاؤه، ويمكن لطلب واحد أن يشغل أكثر من مكالمة. يتم احتساب عمليات جلب الصفحات بنفس المعدل. |
| tools | array | [] | - | تعريفات أدوات استدعاء الوظائف المتوافقة مع OpenAI. |
| tool_choice | object | - | - | التحكم في اختيار الأدوات المتوافق مع OpenAI. |
| response_format | enum | - | - | أرجع مخرجات JSON منظمة. وضع JSON يعيد أي كائن JSON صالح؛ وضع مخطط JSON يفرض المخطط الدقيق الذي تقدمه. |
فوجو ماكس هو القائد متعدد الوكلاء الاقتصادي الاقتصادي: كل طلب يجمع فريقا مناسبا من النماذج الخبيرة للمهمة ويجمع عملهم في إجابة واحدة. التأخير والتدفق - عادة ما تعود الأوامر البسيطة خلال ثوان قليلة، وتستغرق الأوامر الأثقل وقتا أطول أثناء عمل القائد. - يتم إرجاع الإجابة الكاملة دفعة واحدة عند انتهاء النموذج، وليس رمزا برمز. يتم قبول البث، لكنه يعطي الاستجابة الكاملة في النهاية بدلا من الرموز المتدفقة أثناء توليدها. - يجب أن يكون max_tokens على الأقل 16. اترك مساحة واسعة، لأن الحدود الصغيرة جدا قد تقصر أو تفرغ الإجابة. القدرات - إدخال نص وصورة، مع سياق رمز بطول 1 مليون. - التفكير الدائم على التشغيل. العالي هو الافتراضي، Xhigh يزيد الجهد، وماكس يقبل كاسم مستعار ل xhigh. - استدعاء الدوال، ومخرجات منظمة صارمة لمخطط JSON، وبحث ويب مدمج يستشهد بمصدره عند توفره. الفوترة - يتم احتساب الترميز عند الاستخدام الكامل للرمز، بما في ذلك رموز التنسيق التي يستخدمها النموذج داخليا، لذا حتى التعليمات القصيرة تحمل بعض التكلفة. - معدل رمز ثابت واحد عند كل طول سياق، دون معدل أعلى للمطالبات الطويلة. - يتم احتساب البحث على الويب المدمج وجلب الصفحة لكل استدعاء تم تنفيذه بمعدلات المعروضة، ويمكن لطلب واحد أن يشغل أكثر من مكالمة.
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
على EmpirioLabs، تتم فوترة Fugu Max حسب الاستخدام: المدخلات $2.00 لكل 1M رموز مطالبة; الإنتاج $6.00 لكل مليون رمز مولد; قراءة الذاكرة المؤقتة الضمنية $0.25 لكل مليون رمز إدخال مخبأ. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يدعم Fugu Max نافذة سياق من 1M رمز، مع ما يصل إلى 131,072 رمز إخراج لكل استجابة.
نعم. يقدم Fugu Max واجهة Chat Completions المتوافقة مع OpenAI، لذا تعمل حزم OpenAI SDK الحالية بتوجيه base_url إلى https://api.empiriolabs.ai/v1 وتعيين معرّف النموذج إلى fugu-max.
نعم. يشغّل ملعب EmpirioLabs نموذج Fugu Max في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.