Gemma 4 26B-A4B API

Gemma 4 26B A4B es un modelo multimodal abierto de Google con 256K de contexto, texto, imagen y entrada de vídeo, herramientas y salida estructurada.

GoogleGeneracion de texto256K contextoLanzado 31 mar 2026Inferencia nativa

Acerca de Gemma 4 26B-A4B

Gemma 4 26B A4B es un modelo multimodal abierto de Google con 256K de contexto, texto, imagen y entrada de vídeo, herramientas y salida estructurada.

Soporta entrada de texto, imagen y vídeo, streaming, herramientas funcionales, salida JSON estructurada, control semilla y modo de pensamiento activado por defecto. Usa reasoning_effort o thinking_budget para el pensamiento acotado, o enable_thinking=falso para respuestas directas. Las lecturas automáticas de caché se facturan a la tasa de entrada en caché cuando se reportan por el servicio modelo. No se admiten controles explícitos de caché.

También conocido como Google Gemma 4 26B-A4B, Gemma-4-26B-A4B

reasoningvisionvideofunction callingcachemultimodaljson modelogprobs

Especificaciones de Gemma 4 26B-A4B

ID del modelo
gemma-4-26b-a4b
Proveedor
Google
Categoría
Generacion de texto
Lanzado
31 mar 2026
Ventana de contexto
256K tokens
Salida máxima
32.768 tokens
Entrada
TextoImagenVideo
Salida
Texto
Salida estructurada
JSON Schema
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/gemma-4-26b-a4b:generateContent
IDs de modelo alternativos
gemma-4-26b-a4b-itgoogle/gemma-4-26b-a4bgoogle/gemma-4-26b-a4b-it

Precios de la API de Gemma 4 26B-A4BAhorra hasta 83%

Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.15$0.05
Producto
por 1M de tokens generados
$0.50$0.29
Caché implícita
por fichas de entrada en caché de 1M
$0.15$0.025
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013
Comparar en la página completa de precios

Cómo llamar a la API de Gemma 4 26B-A4B

Gemma 4 26B-A4B sirve la API de Chat Completions compatible con OpenAI. Apunta cualquier SDK de OpenAI a https://api.empiriolabs.ai/v1 con tu clave de API de EmpirioLabs y usa el id de modelo gemma-4-26b-a4b. Consigue una clave de API en el panel de EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemma-4-26b-a4b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="gemma-4-26b-a4b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referencia completa de la API de Gemma 4 26B-A4B

Parámetros de la API de Gemma 4 26B-A4B

Parámetros de solicitud compatibles con la API de Gemma 4 26B-A4B en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.

ParámetroTipoPredeterminadoRango / valoresDescripción
temperaturenumber10 a 2Temperatura de muestreo. Los valores más bajos son más deterministas.
top_pnumber0.950 a 1Masa de probabilidad de muestreo del núcleo.
max_tokensinteger40961 a 32768Tokens de salida máximos.
stopstring--Una o más cuerdas de registro.
reasoning_effortenummediumnone, low, medium, high, maxEsfuerzo de razonamiento. ninguno impide el pensamiento; Presupuestos limitados por sets bajos, medios, altos y máximos.
thinking_budgetinteger4096128 a 32768Máximo de fichas de pensamiento antes de la respuesta final. Si max_tokens es menor, el servicio reserva espacio para la respuesta.
enable_thinkingbooleantrue-Activa el canal de razonamiento del modelo antes de la salida final.
top_kinteger201 a 200Limita el muestreo a los K principales tokens candidatos cuando estén soportados.
min_pnumber00 a 1Umbral mínimo de probabilidad para el muestreo de tokens.
presence_penaltynumber0-2 a 2Penalización por tokens que ya aparecieron en el texto generado.
frequency_penaltynumber0-2 a 2Penalización basada en la frecuencia con la que ya ha aparecido un token.
repetition_penaltynumber10.1 a 2Penalización utilizada por SGLang para reducir el texto repetido.
seedinteger-0 a 2147483647Semilla aleatoria opcional para muestreo reproducible.
logprobsbooleanfalse-Devuelve las probabilidades de registro de tokens cuando estén soportadas.
8 parámetros más en la documentación

Información útil

Soporta entrada de texto, imagen y vídeo, streaming, herramientas funcionales, salida JSON estructurada, control semilla y modo de pensamiento activado por defecto. Usa reasoning_effort o thinking_budget para el pensamiento acotado, o enable_thinking=falso para respuestas directas. Las lecturas automáticas de caché se facturan a la tasa de entrada en caché cuando se reportan por el servicio modelo. No se admiten controles explícitos de caché.

API de Gemma 4 26B-A4B: preguntas frecuentes

¿Cuánto cuesta la API de Gemma 4 26B-A4B?

En EmpirioLabs, Gemma 4 26B-A4B se factura por uso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.

¿Cuál es la ventana de contexto de Gemma 4 26B-A4B?

Gemma 4 26B-A4B admite una ventana de contexto de 256K tokens con hasta 32.768 tokens de salida por respuesta.

¿La API de Gemma 4 26B-A4B es compatible con OpenAI?

Sí. Gemma 4 26B-A4B sirve la API de Chat Completions compatible con OpenAI, así que los SDKs de OpenAI existentes funcionan apuntando base_url a https://api.empiriolabs.ai/v1 y usando el id de modelo gemma-4-26b-a4b.

¿Puedo probar Gemma 4 26B-A4B en el navegador antes de integrar?

Sí. El playground de EmpirioLabs ejecuta Gemma 4 26B-A4B en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.

¿Cómo consigo una clave de API de Gemma 4 26B-A4B?

Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.