Step TTS 2 API

StepFun text-to-speech Modell mit offiziellen Stimmen, individuell geklonten Stimmen und Stimmtag-Steuerung.

StepFunAudiogenerationInternationalProprietärer EndpointNeu

Über Step TTS 2

StepFun text-to-speech Modell mit offiziellen Stimmen, individuell geklonten Stimmen und Stimmtag-Steuerung.

Die Zeichenzählung folgt den Preisen von StepFun: Ein chinesisches Zeichen zählt als ein Zeichen, zwei englische Buchstaben als ein Zeichen und zwei Satzzeichen als ein Zeichen.

Auch bekannt als StepFun Step TTS 2, Step-TTS-2

text to speechvoice tagsmultilingual

Step TTS 2 Spezifikationen

Modell-ID
step-tts-2
Anbieter
StepFun
Kategorie
Audiogeneration
Veröffentlicht
-
Eingabe
Text
Ausgabe
Audio
Region
International
Endpoints
POST/v1/audio/speech
Alternative Modell-IDs
stepfun/step-tts-2

Step TTS 2 API-Preise

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Synthese
pro 10.000 Zeichen
$0.40
Auf der vollständigen Preisseite vergleichen

So rufst du die Step TTS 2 API auf

Step TTS 2 erzeugt Sprache über POST /v1/audio/speech und liefert abspielbares Audio. Sende den zu sprechenden Text als input mit der Modell-ID step-tts-2. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "step-tts-2",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "step-tts-2", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
Vollständige Step TTS 2 API-Referenz

Step TTS 2 API-Parameter

Request-Parameter, die die Step TTS 2 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
inputstring-max. 1000Text zur Synthese. Maximal 1.000 Zeichen.
voiceenumlively-girllively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v...Official StepFun voice. Custom cloned voice IDs are also accepted via the API.
response_formatenummp3mp3, wav, flac, opus, pcmAudioformat ausgeben.
speednumber10.5 bis 2Sprachgeschwindigkeit.
volumenumber10.1 bis 2Lautstärke ausgeben.
sample_rateenum240008000, 16000, 22050, 24000Ausgabe-Abtastrate in Hz.
voice_labelobject--Emotions- und Sprechstil-Tags für step-tts-2.
pronunciation_mapobject--Optionale Aussprache-Mapping.
markdown_filterbooleanfalse-Filtere Markdown-Syntax vor der Synthese.

Gut zu wissen

Die maximale Eingabe beträgt 1.000 Zeichen. Unterstützt offizielle Sprach-IDs, benutzerdefinierte geklonte Stimmen, voice_label Emotions-Tags und voice_label-Style-Tags. Der Instruktionsparameter gilt nur für stepaudio-2.5-tts.

Step TTS 2 API: häufige Fragen

Wie viel kostet die Step TTS 2 API?

Auf EmpirioLabs wird Step TTS 2 nach Verbrauch abgerechnet: Synthese $0.40 pro 10.000 Zeichen. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Welchen Endpoint verwendet Step TTS 2?

Step TTS 2 wird über POST /v1/audio/speech auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.

Kann ich Step TTS 2 im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Step TTS 2 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Step TTS 2 API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.