
Gemma 4 26B A4B é um modelo multimodal aberto do Google com 256K de contexto, texto, imagem e vídeo de entrada, ferramentas e saída estruturada.
Gemma 4 26B A4B é um modelo multimodal aberto do Google com 256K de contexto, texto, imagem e vídeo de entrada, ferramentas e saída estruturada.
Suporta entrada de texto, imagem e vídeo, streaming, ferramentas de função, saída JSON estruturada, controle seed e modo de pensamento ativado por padrão. Use reasoning_effort ou thinking_budget para pensamento limitado, ou enable_thinking=falso para respostas diretas. Leituras automáticas de cache são cobradas na taxa de entrada em cache quando reportadas pelo serviço modelo. Controles de cache explícitos não são suportados.
Também conhecido como Google Gemma 4 26B-A4B, Gemma-4-26B-A4B
gemma-4-26b-a4b/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/gemma-4-26b-a4b:generateContentgemma-4-26b-a4b-itgoogle/gemma-4-26b-a4bgoogle/gemma-4-26b-a4b-itTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Gemma 4 26B-A4B atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo gemma-4-26b-a4b. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemma-4-26b-a4b",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="gemma-4-26b-a4b",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Gemma 4 26B-A4B na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| temperature | number | 1 | 0 a 2 | Temperatura de amostragem. Valores mais baixos são mais determinísticos. |
| top_p | number | 0.95 | 0 a 1 | Amostragem do núcleo com a probabilidade de massa. |
| max_tokens | integer | 4096 | 1 a 32768 | Tokens de saída máximos. |
| stop | string | - | - | Uma ou mais cordas de registro. |
| reasoning_effort | enum | medium | none, low, medium, high, max | Esforço de raciocínio. nenhum impede o pensamento; Orçamentos limitados de cenários baixos, médios, altos e máximos. |
| thinking_budget | integer | 4096 | 128 a 32768 | Máximo de tokens de pensamento antes da resposta final. Se max_tokens for menor, o serviço reserva espaço para a resposta. |
| enable_thinking | boolean | true | - | Ative o canal de raciocínio do modelo antes da saída final. |
| top_k | integer | 20 | 1 a 200 | Limite a amostragem aos principais K tokens candidatos quando suportados. |
| min_p | number | 0 | 0 a 1 | Limiar mínimo de probabilidade para amostragem de tokens. |
| presence_penalty | number | 0 | -2 a 2 | Penalidade para tokens que já apareceram no texto gerado. |
| frequency_penalty | number | 0 | -2 a 2 | Penalidade baseada na frequência com que um token já apareceu. |
| repetition_penalty | number | 1 | 0.1 a 2 | Penalidade usada pelo SGLang para reduzir o texto repetido. |
| seed | integer | - | 0 a 2147483647 | Semente aleatória opcional para amostragem reproduzível. |
| logprobs | boolean | false | - | Devolva as probabilidades de logarista dos tokens quando suportado. |
Suporta entrada de texto, imagem e vídeo, streaming, ferramentas de função, saída JSON estruturada, controle seed e modo de pensamento ativado por padrão. Use reasoning_effort ou thinking_budget para pensamento limitado, ou enable_thinking=falso para respostas diretas. Leituras automáticas de cache são cobradas na taxa de entrada em cache quando reportadas pelo serviço modelo. Controles de cache explícitos não são suportados.
Na EmpirioLabs, Gemma 4 26B-A4B é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Gemma 4 26B-A4B suporta uma janela de contexto de 256K tokens com até 32.768 tokens de saída por resposta.
Sim. Gemma 4 26B-A4B atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo gemma-4-26b-a4b.
Sim. O playground da EmpirioLabs executa Gemma 4 26B-A4B no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.