StepAudio 3 Music API

Schreibt vollständige Songs nach einer Stilbeschreibung, mit Gesang, Arrangement und Mischung sowie Instrumentalstücken und Coverversionen.

StepFunAudiogenerationVeröffentlicht 8. Sept. 2026InternationalProprietärer EndpointNeu

Über StepAudio 3 Music

Schreibt vollständige Songs nach einer Stilbeschreibung, mit Gesang, Arrangement und Mischung sowie Instrumentalstücken und Coverversionen.

Die Erzeugung ist asynchron und dauert in der Regel von mehreren zehn Sekunden bis zu einigen Minuten.

Auch bekannt als StepFun StepAudio 3 Music

music generationaudio generationaudio inmultilingual

StepAudio 3 Music Spezifikationen

Modell-ID
stepaudio-3-music
Autor
StepFun
Kategorie
Audiogeneration
Veröffentlicht
8. Sept. 2026
Eingabe
TextAudio
Ausgabe
Audio
Region
International
Endpoints
POST/v1/audio/generations
Alternative Modell-IDs
stepaudio-3-music-previewstepfun/stepaudio-3-music

StepAudio 3 Music API-Preise

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Musikerzeugung
pro erzeugter Sekunde
$0.0018
Auf der vollständigen Preisseite vergleichen

So rufst du die StepAudio 3 Music API auf

StepAudio 3 Music läuft über POST /v1/audio/generations. Der Request liefert sofort eine job_id; frage GET /v1/jobs/{job_id} ab, bis der Job abgeschlossen ist, und lies die Ausgabe-URLs aus dem Ergebnis. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL: Job senden
curl https://api.empiriolabs.ai/v1/audio/generations \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "stepaudio-3-music",
    "prompt": "Describe what you want StepAudio 3 Music to generate."
  }'
cURL: Ergebnis abfragen
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/generations",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "stepaudio-3-music",
        "prompt": "Describe what you want StepAudio 3 Music to generate.",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Vollständige StepAudio 3 Music API-Referenz

StepAudio 3 Music API-Parameter

Request-Parameter, die die StepAudio 3 Music API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
promptstring--Stilbeschreibung: Genre, Gesang, Stimmung, Instrumente und Tonart.
lyricsstring--Optionale Liedtexte. Abschnittstags wie [Vers], [Chorus] und [Outro] formen die Struktur. Bleibt das Modell leer, schreibt das Modell sie. Erforderlich für ein Cover...
taskenumtext_to_musictext_to_music, music_cover, vocal_to_musicSchreibe einen neuen Song, covere einen Referenzsong oder baue ein Arrangement um einen trockenen Gesang herum.
instrumentalbooleanfalse-Erstelle einen Track ohne Gesang. Kann nicht mit Texten kombiniert werden.
song_audiostring--Base64-Referenzsong. Erforderlich für ein Cover.
vocal_audiostring--Base64 trockener Gesang ohne Begleitung. Erforderlich für ein Gesangsarrangement.
response_formatenummp3mp3, wav, flac, opus, pcmAudioformat ausgeben.
temperaturenumber0.850.01 bis 2Temperaturentnahme. Höher ist vielfältiger.
top_pnumber0.920 bis 1Kernprobenwahrscheinlichkeitsmasse.
lyrics_rewritebooleanfalse-Lass das Model die von dir gelieferten Texte umschreiben.

Gut zu wissen

Beschreiben Sie den Stil, und das Modell schreibt und spielt ein vollständiges Lied. Liefern Sie Texte oder lassen Sie das Modell sie schreiben, stellen Sie Instrumentalstücke für einen Track ohne Gesang ein oder fügen Sie ein Referenzlied für ein Cover oder einen trockenen Gesang an, um ein Arrangement aufzubauen. Abschnittstags wie [Vers], [Chorus] und [Outro] formen die Struktur. Die Ausgabelänge wird vom Modell gewählt und beträgt typischerweise ein bis drei Minuten, sodass sie nicht durch einen Parameter festgelegt wird und zwei Durchläufe desselben Prompts sich unterscheiden können. Das Billing folgt der generierten Länge. Instrumental und Liedtext können nicht kombiniert werden. Dieses Modell befindet sich in der Vorschau und seine Fähigkeiten können sich ändern.

StepAudio 3 Music API: häufige Fragen

Wie viel kostet die StepAudio 3 Music API?

Auf EmpirioLabs wird StepAudio 3 Music nach Verbrauch abgerechnet: Musikerzeugung $0.0018 pro erzeugter Sekunde. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Welchen Endpoint verwendet StepAudio 3 Music?

StepAudio 3 Music wird über POST /v1/audio/generations auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.

Kann ich StepAudio 3 Music im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt StepAudio 3 Music im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen StepAudio 3 Music API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.