Gemma 4 26B-A4B एपीआई

जेम्मा 4 26B A4B 256K संदर्भ, टेक्स्ट, छवि और वीडियो इनपुट, टूल और संरचित आउटपुट के साथ एक Google ओपन मल्टीमॉडल मॉडल है।

Googleपाठ निर्माण256K कॉन्टेक्स्टरिलीज 31 मार्च 2026नेटिव इन्फरेंस

Gemma 4 26B-A4B के बारे में

जेम्मा 4 26B A4B 256K संदर्भ, टेक्स्ट, छवि और वीडियो इनपुट, टूल और संरचित आउटपुट के साथ एक Google ओपन मल्टीमॉडल मॉडल है।

डिफ़ॉल्ट रूप से टेक्स्ट, छवि और वीडियो इनपुट, स्ट्रीमिंग, फ़ंक्शन टूल, संरचित JSON आउटपुट, बीज नियंत्रण और सोच मोड का समर्थन करता है। बाध्य सोच के लिए reasoning_effort या thinking_budget का उपयोग करें, या सीधे उत्तरों के लिए enable_thinking=false का उपयोग करें। स्वचालित कैश रीड को कैश्ड-इनपुट दर पर बिल किया जाता है जब मॉडल सेवा द्वारा रिपोर्ट किया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।

इस नाम से भी जाना जाता है Google Gemma 4 26B-A4B, Gemma-4-26B-A4B

reasoningvisionvideofunction callingcachemultimodaljson modelogprobs

Gemma 4 26B-A4B की विशेषताएं

मॉडल ID
gemma-4-26b-a4b
निर्माता
Google
श्रेणी
पाठ निर्माण
रिलीज
31 मार्च 2026
कॉन्टेक्स्ट विंडो
256K टोकन
अधिकतम आउटपुट
32,768 टोकन
इनपुट
टेक्स्टइमेजवीडियो
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON Schema
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/gemma-4-26b-a4b:generateContent
वैकल्पिक मॉडल ID
gemma-4-26b-a4b-itgoogle/gemma-4-26b-a4bgoogle/gemma-4-26b-a4b-it

Gemma 4 26B-A4B API की कीमतें83% तक बचाएं

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$0.15$0.05
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$0.50$0.29
अंतर्निहित कैश पढ़ा गया
प्रति 1M कैश्ड इनपुट टोकन
$0.15$0.025
वेब खोज (लिंकअप)
प्रति कॉल जब लागू किया जाता है
$0.013
पूरे कीमत पेज पर तुलना करें

Gemma 4 26B-A4B API को कैसे कॉल करें

Gemma 4 26B-A4B OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id gemma-4-26b-a4b उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemma-4-26b-a4b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="gemma-4-26b-a4b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Gemma 4 26B-A4B API का पूरा संदर्भ

Gemma 4 26B-A4B API के पैरामीटर

EmpirioLabs पर Gemma 4 26B-A4B API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber10 से 2नमूना तापमान। कम मान अधिक नियतात्मक होते हैं।
top_pnumber0.950 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान।
max_tokensinteger40961 से 32768अधिकतम आउटपुट टोकन।
stopstring--एक या अधिक स्टॉप स्ट्रिंग्स।
reasoning_effortenummediumnone, low, medium, high, maxतर्क प्रयास। कोई भी सोच को अक्षम नहीं करता है; निम्न, मध्यम, उच्च और अधिकतम सेट बाध्य सोच बजट।
enable_thinkingbooleantrue-अंतिम आउटपुट से पहले मॉडल रीजनिंग चैनल को सक्षम करें।
thinking_budgetinteger4096128 से 32768अंतिम उत्तर से पहले अधिकतम सोच टोकन। यदि max_tokens कम है, तो सेवा उत्तर के लिए जगह आरक्षित करती है।
top_kinteger201 से 200समर्थित होने पर नमूनाकरण को शीर्ष K उम्मीदवार टोकन तक सीमित करें।
min_pnumber00 से 1टोकन नमूने के लिए न्यूनतम संभावना सीमा।
presence_penaltynumber0-2 से 2टोकन के लिए जुर्माना जो पहले से ही जेनरेट किए गए टेक्स्ट में दिखाई दे रहे हैं।
frequency_penaltynumber0-2 से 2टोकन कितनी बार पहले ही दिखाई दे चुका है, इसके आधार पर जुर्माना।
repetition_penaltynumber10.1 से 2उच्च मूल्य बार-बार वाक्यांश को हतोत्साहित करते हैं।
seedinteger-0 से 2147483647प्रतिलिपि प्रस्तुत करने योग्य नमूने के लिए वैकल्पिक यादृच्छिक बीज।
logprobsbooleanfalse-समर्थित होने पर टोकन लॉग संभावनाएँ लौटाएँ।
डॉक्स में 8 और पैरामीटर

जानने योग्य

डिफ़ॉल्ट रूप से टेक्स्ट, छवि और वीडियो इनपुट, स्ट्रीमिंग, फ़ंक्शन टूल, संरचित JSON आउटपुट, बीज नियंत्रण और सोच मोड का समर्थन करता है। बाध्य सोच के लिए reasoning_effort या thinking_budget का उपयोग करें, या सीधे उत्तरों के लिए enable_thinking=false का उपयोग करें। स्वचालित कैश रीड को कैश्ड-इनपुट दर पर बिल किया जाता है जब मॉडल सेवा द्वारा रिपोर्ट किया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।

Gemma 4 26B-A4B API: आम सवाल

Gemma 4 26B-A4B API की कीमत कितनी है?

EmpirioLabs पर Gemma 4 26B-A4B का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Gemma 4 26B-A4B की context window कितनी है?

Gemma 4 26B-A4B 256K टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 32,768 आउटपुट टोकन के साथ।

क्या Gemma 4 26B-A4B API OpenAI-संगत है?

हां। Gemma 4 26B-A4B OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id gemma-4-26b-a4b रखकर काम करते हैं।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Gemma 4 26B-A4B आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Gemma 4 26B-A4B को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Gemma 4 26B-A4B की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।