
Deepseek 新架构的轻量旗舰,具备原生图像理解、混合思维、100万上下文支持,以及高达 384K 的输出令牌。
Deepseek 新架构的轻量旗舰,具备原生图像理解、混合思维、100万上下文支持,以及高达 384K 的输出令牌。
支持文本和图像输入、enable_thinking与thinking_budget的混合思维、函数调用、JSON 模式输出,以及可选的 Linkup 网页搜索。思考令牌作为输出令牌计费。
也称为 DeepSeek Flash
deepseek-v4-1-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-1-flash:generateContentdeepseek-v4.1-flashdeepseek/deepseek-v4-1-flashdeepseek-ai/deepseek-v4-1-flash来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
DeepSeek V4.1 Flash 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID deepseek-v4-1-flash。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-1-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="deepseek-v4-1-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上 DeepSeek V4.1 Flash API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 到 2 | 采样温度。0 = 确定性,2 = 最大随机性。 |
| top_p | number | 0.9 | 0 到 1 | 核抽样概率质量。低 = 更专注。 |
| max_tokens | number | 4096 | 1 到 393216 | 最大输出令牌。 |
| stop | string | - | - | 最多有4串字符串,模型会停止生成更多代币。 |
| enable_thinking | boolean | true | - | 在回答之前,先step-by-step理性思考。 |
| reasoning_effort | enum | medium | none, low, medium, high, max | 推理努力程度。没有人能让思考失效。低、中、高和最大设定了根据所选模型大小的有界思维预算。以类似OpenAI的 reasoning_effort 字段形式发送,转换为模型服务的enable_thinking和thinking_budget。 |
| thinking_budget | number | 32768 | 1 到 393216 | 为推理过程保留的最大令牌。到393216。 |
| response_format | enum | - | - | 返回输出为有效的 JSON 对象(JSON 模式)。描述你在提示词中想要的字段。 |
| web_search_linkup | boolean | false | - | 可选的网页搜索由Linkup提供。启用后,最近的网页源会通过最新的用户消息作为查询检索,并作为额外上下文提供给模型。每次调用时,在模型正常的令牌成本基础上额外增加$0.013。默认为禁用。 |
| disable_formatting | boolean | false | - | 启用后,网关不会在使用Linkup网页搜索的助理响应中附加“来源”脚部。当模型输出被传输到另一个不需要装饰的系统时,这很有用。 |
思维默认启用,也可以关闭。推理令牌作为输出令牌计费。图像输入与文本一同接受。支持 JSON 模式。该模型不支持严格的 JSON 模式输出。可选的链接网页搜索仅在调用时计费。
在 EmpirioLabs,DeepSeek V4.1 Flash 按量计费:输入 $0.30 每100万个提示词标记; 产出 $1.20 每100万个生成代币; 网络搜索(链接) $0.013 每次调用时。本页的实时价格表始终与 API 的实际计费一致。
DeepSeek V4.1 Flash 支持 1M token 的上下文窗口,每次响应最多 393,216 个输出 token。
兼容。DeepSeek V4.1 Flash 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 deepseek-v4-1-flash 即可使用。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 DeepSeek V4.1 Flash,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。