首页 博客

如何使用 DeepSeek v4.1 闪存 API

DeepSeek V4.1 Flash API 博客封面

Sep 14, 2026

EmpirioLabs AI

DeepSeek V4.1 闪存版已在EmpirioLabs上架。 它是 Deepseek 新架构家族的轻量旗舰机:一个 552B 参数的 mixture-of-experts 模型,输入有 8B 主动参数,输出为 16B,支持原生图像理解,拥有 100 万个令牌上下文窗口,以及最多 384K 个输出令牌。DeepSeek 在 DeepSeek V4 Pro 之前发布了基准测试结果。

模型的作用

V4.1 Flash 在同一请求中读取文本和图片,因此你可以在提示词旁发送截图、图表和照片。混合思维默认开启:模型先推理再回答,你可以关闭思考以获得更低延迟的回复,或用思考预算来限制。函数调用和 JSON 模式在标准聊天完成表面上运行,启用 Linkup 网页搜索时会添加最新的网页上下文。

如何调用 DeepSeek V4.1 Flash

使用兼容 OpenAI 的聊天完成终端并设置 模型 到 deepseek-v4-1-flash.图像部分采用该标准 image_url 内容块:

curl https://api.empiriolabs.ai/v1/chat/completions \ -h '授权:承载者 $EMPIRIOLABS_API_KEY' \ -h '内容类型:application/json' \ -d '{ “model”: “deepseek-v4-1-flash”, “enable_thinking”: true, “thinking_budget”: 32768, “messages”: [ { “role”: “user”, “content”: [ {“type”: “text”, “text”: “这张图表显示了什么?”用两句话总结趋势。“}, {”type“: ”image_url“, ”image_url“: {”url“: ”https://example.com/chart.png"}} ] }'

相同的模型ID适用于模型页面列出的响应、消息和兼容Gemini的端点。

作战笔记

  • JSON 模式(a response_format 类型 json_object) 需要在你的消息中某个词中加入 json 这个词。该模型不支持严格的 JSON Schema 响应格式。
  • 推理令牌作为输出令牌计费。集合 启用 思考 到 错误 简短、延迟敏感的回复,或更低的回复 thinking_budget 用来约束推理。

定价

令牌使用以一个已发布的输入速率和一个已发布输出速率计费,没有单独的缓存输入速率。连接网页搜索只有在运行时才会增加少量每次通话费用。查看实时 模型页面 以及 定价页面 以当前利率为例。

开始建造

试试 DeepSeek v4.1 闪存 游戏场,阅读 API 文档,或者将其与其他模型进行比较 型号目录。 。 。.

披露:这篇文章是在AI的协助下撰写的,并由EmpirioLabs AI审查.

准备好使用更好的终端了吗?

欢迎浏览我们的模型,或联系我们洽谈业务咨询、定制部署或其他任何事宜。