Gemma 4 26B-A4B API

Gemma 4 26B A4B ist ein Google-offenes multimodales Modell mit 256K-Kontext, Text-, Bild- und Videoeingaben, Werkzeugen und strukturierter Ausgabe.

GoogleTextgenerierung256K KontextVeröffentlicht 31. März 2026Native Inferenz

Über Gemma 4 26B-A4B

Gemma 4 26B A4B ist ein Google-offenes multimodales Modell mit 256K-Kontext, Text-, Bild- und Videoeingaben, Werkzeugen und strukturierter Ausgabe.

Unterstützt Text-, Bild- und Videoeingabe, Streaming, Funktionstools, strukturierte JSON-Ausgabe, Seed-Steuerung und standardmäßig aktivierten Denkmodus. Verwenden Sie reasoning_effort oder thinking_budget für begrenztes Denken oder enable_thinking=falsch für direkte Antworten. Automatische Cache-Lesearten werden mit der vom Modelldienst gemeldeten Eingaberate berechnet. Explizite Cache-Kontrollen werden nicht unterstützt.

Auch bekannt als Google Gemma 4 26B-A4B, Gemma-4-26B-A4B

reasoningvisionvideofunction callingcachemultimodaljson modelogprobs

Gemma 4 26B-A4B Spezifikationen

Modell-ID
gemma-4-26b-a4b
Anbieter
Google
Kategorie
Textgenerierung
Veröffentlicht
31. März 2026
Kontextfenster
256K Token
Max. Ausgabe
32.768 Token
Eingabe
TextBildVideo
Ausgabe
Text
Strukturierte Ausgabe
JSON Schema
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/gemma-4-26b-a4b:generateContent
Alternative Modell-IDs
gemma-4-26b-a4b-itgoogle/gemma-4-26b-a4bgoogle/gemma-4-26b-a4b-it

Gemma 4 26B-A4B API-PreiseSpare bis zu 83%

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$0.15$0.05
Ausgabe
pro 1 Million generierter Token
$0.50$0.29
Implizite Cache-Leseart
pro 1M zwischengespeicherten Eingabetoken
$0.15$0.025
Websuche (Linkup)
pro Aufruf beim Aufruf
$0.013
Auf der vollständigen Preisseite vergleichen

So rufst du die Gemma 4 26B-A4B API auf

Gemma 4 26B-A4B bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID gemma-4-26b-a4b. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemma-4-26b-a4b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="gemma-4-26b-a4b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige Gemma 4 26B-A4B API-Referenz

Gemma 4 26B-A4B API-Parameter

Request-Parameter, die die Gemma 4 26B-A4B API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
temperaturenumber10 bis 2Temperatur wird geprochen. Niedrigere Werte sind deterministischer.
top_pnumber0.950 bis 1Kernprobenwahrscheinlichkeitsmasse.
max_tokensinteger40961 bis 32768Maximale Ausgabe-Token.
stopstring--Eine oder mehrere Register-Saiten.
reasoning_effortenummediumnone, low, medium, high, maxVernunft und Mühe. keines verhindert das Denken; Niedrige, mittlere, hohe und maximale begrenzte Denkbudgets.
thinking_budgetinteger4096128 bis 32768Maximale Denk-Tokens vor der endgültigen Antwort. Ist max_tokens niedriger, reserviert der Dienst Platz für die Antwort.
enable_thinkingbooleantrue-Aktivieren Sie den Modell-Logikkanal vor der endgültigen Ausgabe.
top_kinteger201 bis 200Begrenze das Sampling auf die besten K Kandidatentoken, wenn sie unterstützt werden.
min_pnumber00 bis 1Mindestwahrscheinlichkeitsschwelle für Token-Sampling.
presence_penaltynumber0-2 bis 2Strafe für Token, die bereits im generierten Text erschienen sind.
frequency_penaltynumber0-2 bis 2Strafe basiert darauf, wie oft ein Token bereits aufgetaucht ist.
repetition_penaltynumber10.1 bis 2Strafe wird von SGLang verwendet, um wiederholte Texte zu reduzieren.
seedinteger-0 bis 2147483647Optionaler zufälliger Seed für reproduzierbare Stichproben.
logprobsbooleanfalse-Geben Sie Token-Log-Wahrscheinlichkeiten zurück, wenn sie unterstützt werden.
8 weitere Parameter in den Docs

Gut zu wissen

Unterstützt Text-, Bild- und Videoeingabe, Streaming, Funktionstools, strukturierte JSON-Ausgabe, Seed-Steuerung und standardmäßig aktivierten Denkmodus. Verwenden Sie reasoning_effort oder thinking_budget für begrenztes Denken oder enable_thinking=falsch für direkte Antworten. Automatische Cache-Lesearten werden mit der vom Modelldienst gemeldeten Eingaberate berechnet. Explizite Cache-Kontrollen werden nicht unterstützt.

Gemma 4 26B-A4B API: häufige Fragen

Wie viel kostet die Gemma 4 26B-A4B API?

Auf EmpirioLabs wird Gemma 4 26B-A4B nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von Gemma 4 26B-A4B?

Gemma 4 26B-A4B unterstützt ein Kontextfenster von 256K Token mit bis zu 32.768 Ausgabe-Token pro Antwort.

Ist die Gemma 4 26B-A4B API OpenAI-kompatibel?

Ja. Gemma 4 26B-A4B bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID gemma-4-26b-a4b verwendest.

Kann ich Gemma 4 26B-A4B im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Gemma 4 26B-A4B im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Gemma 4 26B-A4B API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.