
Gemma 4 26B A4B是一个Google开放的多式联运模型,包含256K上下文,文本,图像,以及视频输入,工具,和结构化输出.
Gemma 4 26B A4B是一个Google开放的多式联运模型,包含256K上下文,文本,图像,以及视频输入,工具,和结构化输出.
支持文本,图像,和视频输入,流线,函数工具,结构化的JSON输出,种子控制,以及默认的思维模式. 使用推理 努力或思考 预算来进行有限度的思考, 或者允许 思考=虚假来直接回答 。 自动缓存读数在模型服务报告时按缓存输入率计费. 不支持明确的缓存控制 。
也称为 Google Gemma 4 26B-A4B, Gemma-4-26B-A4B
gemma-4-26b-a4b/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/gemma-4-26b-a4b:generateContentgemma-4-26b-a4b-itgoogle/gemma-4-26b-a4bgoogle/gemma-4-26b-a4b-it来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Gemma 4 26B-A4B 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID gemma-4-26b-a4b。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemma-4-26b-a4b",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="gemma-4-26b-a4b",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上 Gemma 4 26B-A4B API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| temperature | number | 1 | 0 到 2 | 采样温度。较低的数值则更具确定性。 |
| top_p | number | 0.95 | 0 到 1 | 核抽样概率质量。 |
| max_tokens | integer | 4096 | 1 到 32768 | 最大输出令牌。 |
| stop | string | - | - | 一根或多根音栓。 |
| reasoning_effort | enum | medium | none, low, medium, high, max | 推理努力。没有人能阻止思考;低、中、高和最高设定了有限的思维预算。 |
| thinking_budget | integer | 4096 | 128 到 32768 | 在最终答案前使用最多思考代币。如果max_tokens较低,服务为答案保留空间。 |
| enable_thinking | boolean | true | - | 在最终输出前启用模型推理通道。 |
| top_k | integer | 20 | 1 到 200 | 支持时,限制抽样仅限于顶K候选代币。 |
| min_p | number | 0 | 0 到 1 | 代币抽样的最小概率阈值。 |
| presence_penalty | number | 0 | -2 到 2 | 对已出现在生成文本中的代币进行惩罚。 |
| frequency_penalty | number | 0 | -2 到 2 | 惩罚基于代币出现的频率。 |
| repetition_penalty | number | 1 | 0.1 到 2 | SGLang 用于减少重复文本的惩罚。 |
| seed | integer | - | 0 到 2147483647 | 可选的随机种子用于可复现抽样。 |
| logprobs | boolean | false | - | 支持时返回令牌日志概率。 |
支持文本,图像,和视频输入,流线,函数工具,结构化的JSON输出,种子控制,以及默认的思维模式. 使用推理 努力或思考 预算来进行有限度的思考, 或者允许 思考=虚假来直接回答 。 自动缓存读数在模型服务报告时按缓存输入率计费. 不支持明确的缓存控制 。
在 EmpirioLabs,Gemma 4 26B-A4B 按量计费。本页的实时价格表始终与 API 的实际计费一致。
Gemma 4 26B-A4B 支持 256K token 的上下文窗口,每次响应最多 32,768 个输出 token。
兼容。Gemma 4 26B-A4B 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 gemma-4-26b-a4b 即可使用。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Gemma 4 26B-A4B,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。