
Agentenoptimierte Step 3.5 Flash-Variante mit niedrigen und hohen Denkaufwand-Modi.
Agentenoptimierte Step 3.5 Flash-Variante mit niedrigen und hohen Denkaufwand-Modi.
Nutze reasoning_effort Low, um Reasoning-Tokens zu reduzieren, oder High für tiefere Agentenarbeit. Prompt-Cache-Hits werden zu StepFun-Cache-Hit-Raten abgerechnet. Linkup-Websuche ist über web_search_linkup verfügbar und fügt beim Aufruf $0.013 pro Aufruf hinzu.
Auch bekannt als Step Flash 2603, StepFun Step 3.5 Flash 2603, Step-3.5-Flash-2603, step-3-5-flash-2603
step-3-5-flash-2603/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/step-3-5-flash-2603:generateContentstep-3.5-flash-2603stepfun/step-3-5-flash-2603stepfun/step-3.5-flash-2603Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Step 3.5 Flash 2603 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID step-3-5-flash-2603. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "step-3-5-flash-2603",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="step-3-5-flash-2603",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Step 3.5 Flash 2603 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| temperature | number | 0.5 | 0 bis 2 | Temperatur wird geprochen. |
| top_p | number | 0.9 | 0 bis 1 | Kernprobenwahrscheinlichkeitsmasse. |
| max_tokens | integer | 4096 | 1 bis 131072 | Maximale Ausgabe-Token. Reasoning-Tokens zählen zu diesem Limit. |
| stop | array | - | - | Stopp-Sequenzen. |
| frequency_penalty | number | 0 | 0 bis 1 | Strafe für wiederholte Tokens. |
| reasoning_effort | enum | low | low, high | Begründung für die agentenoptimierte Step 3.5 Flash 2603-Route. |
| reasoning_format | enum | general | general, deepseek-style | Reasoning-Trace-Format wird von StepFun zurückgegeben. |
| tools | array | - | - | OpenAI-kompatible Funktionstools. |
| tool_choice | string | - | - | Wahl des OpenAI-kompatiblen Tools. |
| web_search_linkup | boolean | false | - | Optionale Websuche, betrieben von Linkup. Wenn aktiviert, werden aktuelle Webquellen mit Ihrer neuesten Benutzernachricht als Abfrage abgerufen und dem Modell als zusätzlicher Kontext bereitgestellt. Fügt $0.013 pro Aufruf hinzu, wenn er aufgerufen wird, zusätzlich zu den normalen Tokenkosten des Modells. Standardmäßig deaktiviert. |
Text-only-Agentenmodell mit 256K-Kontext, Funktionstools, Prompt-Cache-Abrechnung, reasoning_effort niedrig oder hoch sowie optionaler Linkup-Websuche.
Auf EmpirioLabs wird Step 3.5 Flash 2603 nach Verbrauch abgerechnet: Input $0.10 pro 1M prompte Token; Output $0.30 pro 1M generierte Token; Impliziter Cache Read $0.02 pro 1M zwischengespeicherte Eingangstoken. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Step 3.5 Flash 2603 unterstützt ein Kontextfenster von 256K Token mit bis zu 131.072 Ausgabe-Token pro Antwort.
Ja. Step 3.5 Flash 2603 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID step-3-5-flash-2603 verwendest.
Ja. Der EmpirioLabs Playground führt Step 3.5 Flash 2603 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.