
Modèle de raisonnement textuel StepFun pour agents, codage, appel d’outils et analyse à long contexte.
Modèle de raisonnement textuel StepFun pour agents, codage, appel d’outils et analyse à long contexte.
Les visites de prompt cache sont facturées selon les taux de réussite de cache StepFun. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par appel lors de l’invocation.
Aussi connu sous le nom Step Flash, StepFun Step 3.5 Flash, Step-3.5-Flash, step-3-5-flash
step-3-5-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/step-3-5-flash:generateContentstep-3.5-flashstepfun/step-3-5-flashstepfun/step-3.5-flashTarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
Step 3.5 Flash sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle step-3-5-flash. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "step-3-5-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="step-3-5-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Paramètres de requête pris en charge par l'API Step 3.5 Flash sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.
| Paramètre | Type | Par défaut | Plage / valeurs | Description |
|---|---|---|---|---|
| temperature | number | 0.5 | 0 à 2 | Température d’échantillonnage. |
| top_p | number | 0.9 | 0 à 1 | Probabilité d’échantillonnage du noyau, masse. |
| max_tokens | integer | 4096 | 1 à 131072 | Jetons de sortie maximum. Les jetons de raisonnement comptent pour cette limite. |
| stop | array | - | - | Arrêtez les séquences. |
| frequency_penalty | number | 0 | 0 à 1 | Pénalité pour jetons répétés. |
| reasoning_format | enum | general | general, deepseek-style | Format de trace de raisonnement retourné par StepFun. |
| tools | array | - | - | Outils fonctionnels compatibles OpenAI. |
| tool_choice | string | - | - | Choix d’outil compatible OpenAI. |
| web_search_linkup | boolean | false | - | Recherche web optionnelle propulsée par Linkup. Lorsqu’activées, les sources web récentes sont récupérées en utilisant votre dernier message utilisateur comme requête et fournies au modèle comme contexte supplémentaire. Ajoute $0.013 par appel lorsqu’il est invoqué en plus du coût normal du jeton du modèle. Désactivé par défaut. |
Raisonnement uniquement texte avec contexte 256K, outils fonctionnels, facturation par cache invitée et recherche web optionnelle sur Linkup.
Sur EmpirioLabs, Step 3.5 Flash est facturé à l'usage : Entrée $0.10 par jetons 1M; Produit $0.30 par jeton généré 1M; cache implicite lu $0.02 par jetons d'entrée en cache 1M. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
Step 3.5 Flash prend en charge une fenêtre de contexte de 256K tokens avec jusqu'à 131 072 tokens de sortie par réponse.
Oui. Step 3.5 Flash sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle step-3-5-flash.
Oui. Le playground EmpirioLabs exécute Step 3.5 Flash dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.