
Variante Flash Step 3.5 optimisée pour agent avec des modes d’effort de raisonnement faible et élevé.
Variante Flash Step 3.5 optimisée pour agent avec des modes d’effort de raisonnement faible et élevé.
Utilisez reasoning_effort faible pour réduire les jetons de raisonnement ou haut pour un travail plus profond sur les agents. Les visites de prompt cache sont facturées selon les taux de réussite de cache StepFun. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par appel lors de l’invocation.
Aussi connu sous le nom Step Flash 2603, StepFun Step 3.5 Flash 2603, Step-3.5-Flash-2603, step-3-5-flash-2603
step-3-5-flash-2603/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/step-3-5-flash-2603:generateContentstep-3.5-flash-2603stepfun/step-3-5-flash-2603stepfun/step-3.5-flash-2603Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
Step 3.5 Flash 2603 sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle step-3-5-flash-2603. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "step-3-5-flash-2603",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="step-3-5-flash-2603",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Paramètres de requête pris en charge par l'API Step 3.5 Flash 2603 sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.
| Paramètre | Type | Par défaut | Plage / valeurs | Description |
|---|---|---|---|---|
| temperature | number | 0.5 | 0 à 2 | Température d’échantillonnage. |
| top_p | number | 0.9 | 0 à 1 | Probabilité d’échantillonnage du noyau, masse. |
| max_tokens | integer | 4096 | 1 à 131072 | Jetons de sortie maximum. Les jetons de raisonnement comptent pour cette limite. |
| stop | array | - | - | Arrêtez les séquences. |
| frequency_penalty | number | 0 | 0 à 1 | Pénalité pour jetons répétés. |
| reasoning_effort | enum | low | low, high | Effort de raisonnement pour la route Flash 2603 de Step 3.5 optimisée pour les agents. |
| reasoning_format | enum | general | general, deepseek-style | Format de trace de raisonnement retourné par StepFun. |
| tools | array | - | - | Outils fonctionnels compatibles OpenAI. |
| tool_choice | string | - | - | Choix d’outil compatible OpenAI. |
| web_search_linkup | boolean | false | - | Recherche web optionnelle propulsée par Linkup. Lorsqu’activées, les sources web récentes sont récupérées en utilisant votre dernier message utilisateur comme requête et fournies au modèle comme contexte supplémentaire. Ajoute $0.013 par appel lorsqu’il est invoqué en plus du coût normal du jeton du modèle. Désactivé par défaut. |
Modèle d’agent uniquement texte avec contexte 256K, outils de fonction, facturation par cache d’invitation, reasoning_effort faible ou élevé, et recherche web Linkup optionnelle.
Sur EmpirioLabs, Step 3.5 Flash 2603 est facturé à l'usage : Entrée $0.10 par jetons 1M; Produit $0.30 par jeton généré 1M; cache implicite lu $0.02 par jetons d'entrée en cache 1M. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
Step 3.5 Flash 2603 prend en charge une fenêtre de contexte de 256K tokens avec jusqu'à 131 072 tokens de sortie par réponse.
Oui. Step 3.5 Flash 2603 sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle step-3-5-flash-2603.
Oui. Le playground EmpirioLabs exécute Step 3.5 Flash 2603 dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.