
StepFun Text-Reasoning-Modell für Agenten, Programmierung, Werkzeugaufrufe und Langkontextanalyse.
StepFun Text-Reasoning-Modell für Agenten, Programmierung, Werkzeugaufrufe und Langkontextanalyse.
Prompt-Cache-Hits werden zu StepFun-Cache-Hit-Raten abgerechnet. Linkup-Websuche ist über web_search_linkup verfügbar und fügt beim Aufruf $0.013 pro Aufruf hinzu.
Auch bekannt als Step Flash, StepFun Step 3.5 Flash, Step-3.5-Flash, step-3-5-flash
step-3-5-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/step-3-5-flash:generateContentstep-3.5-flashstepfun/step-3-5-flashstepfun/step-3.5-flashLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Step 3.5 Flash bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID step-3-5-flash. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "step-3-5-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="step-3-5-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Step 3.5 Flash API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| temperature | number | 0.5 | 0 bis 2 | Temperatur wird geprochen. |
| top_p | number | 0.9 | 0 bis 1 | Kernprobenwahrscheinlichkeitsmasse. |
| max_tokens | integer | 4096 | 1 bis 131072 | Maximale Ausgabe-Token. Reasoning-Tokens zählen zu diesem Limit. |
| stop | array | - | - | Stopp-Sequenzen. |
| frequency_penalty | number | 0 | 0 bis 1 | Strafe für wiederholte Tokens. |
| reasoning_format | enum | general | general, deepseek-style | Reasoning-Trace-Format wird von StepFun zurückgegeben. |
| tools | array | - | - | OpenAI-kompatible Funktionstools. |
| tool_choice | string | - | - | Wahl des OpenAI-kompatiblen Tools. |
| web_search_linkup | boolean | false | - | Optionale Websuche, betrieben von Linkup. Wenn aktiviert, werden aktuelle Webquellen mit Ihrer neuesten Benutzernachricht als Abfrage abgerufen und dem Modell als zusätzlicher Kontext bereitgestellt. Fügt $0.013 pro Aufruf hinzu, wenn er aufgerufen wird, zusätzlich zu den normalen Tokenkosten des Modells. Standardmäßig deaktiviert. |
Nur Text-Argumentation mit 256K-Kontext, Funktionstools, Prompt-Cache-Abrechnung und optionaler Linkup-Websuche.
Auf EmpirioLabs wird Step 3.5 Flash nach Verbrauch abgerechnet: Input $0.10 pro 1M prompte Token; Output $0.30 pro 1M generierte Token; Impliziter Cache Read $0.02 pro 1M zwischengespeicherte Eingangstoken. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Step 3.5 Flash unterstützt ein Kontextfenster von 256K Token mit bis zu 131.072 Ausgabe-Token pro Antwort.
Ja. Step 3.5 Flash bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID step-3-5-flash verwendest.
Ja. Der EmpirioLabs Playground führt Step 3.5 Flash im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.