Step 5 プレビューはStepFunのフロンティア推論モデルです。テキスト、画像、動画の入力を受け付け、回答はテキストで、1,024,000トークンコンテキストを持ちます。並列関数呼び出し、厳密なJSONスキーマ構造化出力、自動プロンプトキャッシュ、3レベルにわたる推論努力制御をサポートしています。
本日、OpenAI互換APIを通じてEmpirioLabsで配信されており、ストリーミングと最大131,072の出力トークンを備えています。試してみてください プレイグラウンド または、OpenAI対応のクライアントから呼び出す。 フルスペックと現在のレートは、 ステップ5 プレビューモデルページ そして、 API ドキュメントお問い合わせ.
判断
OpenAI互換クライアントは https://api.empiriolabs.ai/v1 および用途 step-5-preview モデルIDとして。
curl https://api.empiriolabs.ai/v1/chat/completions \ -h "認証:ベアラー $EMPIRIOLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "step-5-preview", "messages": [{"role": "user", "content": "Plan a three step migration from a monolith."}], "reasoning_effort": "high", "max_tokens": 2000 }'
同じモデルがResponses API、Anthropic Messagesフォーマット、Gemini互換ルートに対応しているため、ほとんどの既存クライアントは書き換えなしで動作します。その ドキュメントページ サポートされるすべてのエンドポイントを一覧にします。
画像と映像の扱い
標準画像を添付してください image_url コンテンツ部分、または video_url 部分。どちらもURLまたはデータURLを受け入れます。動画は128MB以内に抑え、クリップは約5分以内に抑えて最も信頼性の高い結果が得られます。
最初の電話をかける前に知っておくべき3つのこと
- 理由は再び戻ってきます
理由 内容、そして出力として請求されます。 これらのトークンはcompletion_tokens、しかしcompletion_tokens_details.reasoning_tokensレポートゼロ、読んでくださいcompletion_tokens支出を割り当てるときの論理的なサブカウントではなく。 - 現実をセットしてください
max_tokensお問い合わせ. 理由付けは回答と同じ予算から使われるので、小さな予算でもハードプロンプトに対して空のメッセージを返すこともあります。余裕を持たせてください。 - キャッシュは自動的に行われており、それが見て取れます。 長い共有プレフィックスを送信すると、次のリクエストでヒットが報告されます
prompt_tokens_details.cached_tokensモデルページのキャッシュリードレートで請求されます。プロンプトの安定部分を前面に置くことでメリットがあります。
一つだけ 理由 努力: ロー, メディア、および 高く はサポートされるレベルです。リクエストで他の値は受け入れられ、その後無視されるため、カスタム文字列に頼らず3つのうち1つを送るのが良いです。
費用は何だ
ステップ5プレビューは、トークンごとに請求され、キャッシュ入力に対しては別額割引料金で、サブスクリプションは不要です。現在の料金は モデルページ そして、 プライシングページお問い合わせ.



