DeepSeek V4.1 闪存版已在EmpirioLabs上架。 它是 Deepseek 新架构家族的轻量旗舰机:一个 552B 参数的 mixture-of-experts 模型,输入有 8B 主动参数,输出为 16B,支持原生图像理解,拥有 100 万个令牌上下文窗口,以及最多 384K 个输出令牌。DeepSeek 在 DeepSeek V4 Pro 之前发布了基准测试结果。
模型的作用
V4.1 Flash 在同一请求中读取文本和图片,因此你可以在提示词旁发送截图、图表和照片。混合思维默认开启:模型先推理再回答,你可以关闭思考以获得更低延迟的回复,或用思考预算来限制。函数调用和 JSON 模式在标准聊天完成表面上运行,启用 Linkup 网页搜索时会添加最新的网页上下文。
如何调用 DeepSeek V4.1 Flash
使用兼容 OpenAI 的聊天完成终端并设置 模型 到 deepseek-v4-1-flash.图像部分采用该标准 image_url 内容块:
curl https://api.empiriolabs.ai/v1/chat/completions \ -h '授权:承载者 $EMPIRIOLABS_API_KEY' \ -h '内容类型:application/json' \ -d '{ “model”: “deepseek-v4-1-flash”, “enable_thinking”: true, “thinking_budget”: 32768, “messages”: [ { “role”: “user”, “content”: [ {“type”: “text”, “text”: “这张图表显示了什么?”用两句话总结趋势。“}, {”type“: ”image_url“, ”image_url“: {”url“: ”https://example.com/chart.png"}} ] }'
相同的模型ID适用于模型页面列出的响应、消息和兼容Gemini的端点。
作战笔记
- JSON 模式(a
response_format类型json_object) 需要在你的消息中某个词中加入 json 这个词。该模型不支持严格的 JSON Schema 响应格式。 - 推理令牌作为输出令牌计费。集合
启用 思考到错误简短、延迟敏感的回复,或更低的回复thinking_budget用来约束推理。
定价
令牌使用以一个已发布的输入速率和一个已发布输出速率计费,没有单独的缓存输入速率。连接网页搜索只有在运行时才会增加少量每次通话费用。查看实时 模型页面 以及 定价页面 以当前利率为例。
开始建造
试试 DeepSeek v4.1 闪存 游戏场,阅读 API 文档,或者将其与其他模型进行比较 型号目录。 。 。.
披露:这篇文章是在AI的协助下撰写的,并由EmpirioLabs AI审查.



