
Raciocínio multimodal Frontier com contexto de token de 1M, entrada de imagem e vídeo, chamada paralela de ferramentas e saída estrita de esquema JSON.
Raciocínio multimodal Frontier com contexto de token de 1M, entrada de imagem e vídeo, chamada paralela de ferramentas e saída estrita de esquema JSON.
Use reasoning_effort baixo, médio ou alto para controlar o orçamento de raciocínio. O modelo retorna seu raciocínio em reasoning_content, e esses tokens são faturados como tokens de saída. Os encontros no prompt cache são faturados na taxa de leitura do cache. A busca web do Linkup está disponível através do web_search_linkup e adiciona $0.013 por chamada quando invocada.
Também conhecido como StepFun Step 5 Preview
step-5-preview/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/step-5-preview:generateContentstepfun/step-5-previewTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Step 5 Preview atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo step-5-preview. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "step-5-preview",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="step-5-preview",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Step 5 Preview na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| temperature | number | 0.5 | 0 a 2 | Temperatura de amostragem. |
| top_p | number | 0.9 | 0 a 1 | Amostragem do núcleo com a probabilidade de massa. |
| max_tokens | integer | 4096 | 1 a 131072 | Tokens de saída máximos. Os tokens de raciocínio contam para esse limite. |
| stop | array | - | - | Sequências de paradas. |
| frequency_penalty | number | 0 | 0 a 1 | Penalidade por tokens repetidos. |
| reasoning_effort | enum | low | low, medium, high | Controla o quanto o modelo raciocina antes de responder. Esforço maior gasta mais tokens em raciocínio. |
| reasoning_format | enum | general | general, deepseek-style | O formato da traça de raciocínio retornou junto com a resposta. |
| tools | array | - | - | Ferramentas funcionais compatíveis com OpenAI. |
| tool_choice | string | - | - | Escolha de ferramenta compatível com OpenAI. |
| response_format | object | - | - | Restringa a saída a JSON válido. Use o modo JSON para qualquer objeto JSON, ou forneça um Esquema JSON para forçar uma forma exata de resposta. |
| web_search_linkup | boolean | false | - | Busca opcional na web alimentada pelo Linkup. Quando ativadas, fontes web recentes são recuperadas usando sua última mensagem de usuário como consulta e fornecidas ao modelo como contexto adicional. Adiciona $0.013 por chamada quando invocada, além do custo normal do token do modelo. Desativado por padrão. |
| disable_formatting | boolean | false | - | Quando ativado, o gateway não adiciona o rodapé "Fontes" às respostas assistentes que usaram busca web do Linkup. Útil quando a saída do modelo é canalizada para... |
Suporta entrada de texto, imagem e vídeo com contexto de token de 1M, ferramentas de função paralela, saída rigorosa de esquema JSON e reasoning_effort baixa, média ou alta. As visualizações no prompt cache são faturadas na taxa de leitura do cache. Entrada de vídeo suporta MP4 abaixo de 128 MB, com clipes abaixo de 5 minutos recomendados. Esta é uma versão prévia, então seu comportamento e identificador podem mudar.
Na EmpirioLabs, Step 5 Preview é cobrado por uso: Entrada $1.00 por 1M de tokens de prompt; Saída $2.70 por 1M de tokens gerados; Leitura implícita do cache $0.05 por 1M de tokens de entrada cacheados; Busca na Web (Linkup) $0.013 por chamada quando invocada. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Step 5 Preview suporta uma janela de contexto de 1.02M tokens com até 131.072 tokens de saída por resposta.
Sim. Step 5 Preview atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo step-5-preview.
Sim. O playground da EmpirioLabs executa Step 5 Preview no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.