Step 5 预览是 StepFun 的前沿推理模型。它接受文本、图片和视频输入,文本回答,并携带 1,024,000 个令牌上下文。支持并行函数调用、严格的 JSON 模式结构化输出、自动提示缓存以及三层推理工作控制。
它今天通过兼容 OpenAI 的 API 上线EmpirioLabs,支持流媒体和最多 131,072 个输出令牌。试试看 操场 或者从任何 OpenAI 兼容客户端调用它。 全部谱率和当前率 步骤5 预览模型页面 页:1 API 文档。 。 。.
叫它
指向任何兼容 OpenAI 的客户端 https://api.empiriolabs.ai/v1 (英语) 以及使用 step-5-preview 作为模特ID。
curl https://api.empiriolabs.ai/v1/chat/completions \ -h “授权:承载者 $EMPIRIOLABS_API_KEY” \ -h “内容类型:application/json” \ -d '{ “model”: “step-5-preview”, “messages”: [{“role”: “user”, “content”: “计划从单体迁移三步。”}], “reasoning_effort”: “高”, “max_tokens”: 2000 }'
同一模型在Responses API、Anthropic Messages格式和Gemini兼容路由上都有答案,因此大多数现有客户端无需重写即可工作。该 文档页面 列出所有支持的端点。
与图像和视频的结合
附上带有标准的图片 image_url 内容部分,或带有 video_url 部分。两者都接受URL或数据URL。视频控制在128MB以内,剪辑不超过约五分钟,以获得最可靠的结果。
在你第一次打电话前,有三件事值得你了解
- 理由又回到了
推理(c),并以输出计费。 这些代币包含在completion_tokens, 但completion_tokens_details.reasoning_tokens零报告,请阅读completion_tokens而不是在你归因于支出时的推理子计数。 - 设定一个真实的
max_tokens。 。 。. 推理和答案预算相同,所以小预算可以回复一个空白提示。给它留出空间。 - 缓存是自动的,你能看出来。 发送一个长共享前缀,下一个请求会报告命中结果
prompt_tokens_details.cached_tokens按模型页的缓存读取率计费。保持提示词的稳定部分在前面,这样会受益。
关于 推理(e)编号: 低, (中文), 媒介, 和 高 是支持的级别。请求接受其他值后会忽略,因此发送三个值中的一个,而不是依赖自定义字符串。



