Step TTS 2 API

StepFun text-to-speech modelo con voces oficiales, voces clonadas personalizadas y controles de etiqueta de voz.

StepFunGeneración de audioInternationalEndpoint propietarioNuevo

Acerca de Step TTS 2

StepFun text-to-speech modelo con voces oficiales, voces clonadas personalizadas y controles de etiqueta de voz.

El conteo de caracteres sigue la tarifación de StepFun: un carácter chino cuenta como un carácter, dos letras inglesas cuentan como un carácter y dos signos de puntuación cuentan como un carácter.

También conocido como StepFun Step TTS 2, Step-TTS-2

text to speechvoice tagsmultilingual

Especificaciones de Step TTS 2

ID del modelo
step-tts-2
Proveedor
StepFun
Categoría
Generación de audio
Lanzado
-
Entrada
Texto
Salida
Audio
Región
International
Endpoints
POST/v1/audio/speech
IDs de modelo alternativos
stepfun/step-tts-2

Precios de la API de Step TTS 2

Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.

Tipo
Especificación
Tarifa
Síntesis
por cada 10.000 caracteres
$0.40
Comparar en la página completa de precios

Cómo llamar a la API de Step TTS 2

Step TTS 2 genera voz a través de POST /v1/audio/speech y devuelve audio reproducible. Envía el texto a pronunciar como input con el id de modelo step-tts-2. Consigue una clave de API en el panel de EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "step-tts-2",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "step-tts-2", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
Referencia completa de la API de Step TTS 2

Parámetros de la API de Step TTS 2

Parámetros de solicitud compatibles con la API de Step TTS 2 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.

ParámetroTipoPredeterminadoRango / valoresDescripción
inputstring-máx. 1000Texto para sintetizar. Máximo 1.000 caracteres.
voiceenumlively-girllively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v...Official StepFun voice. Custom cloned voice IDs are also accepted via the API.
response_formatenummp3mp3, wav, flac, opus, pcmFormato de audio de salida.
speednumber10.5 a 2Velocidad del habla.
volumenumber10.1 a 2Volumen de salida.
sample_rateenum240008000, 16000, 22050, 24000Tasa de muestreo de salida en Hz.
voice_labelobject--Etiquetas de emoción y estilo habla para step-tts-2.
pronunciation_mapobject--Mapeo de pronunciación opcional.
markdown_filterbooleanfalse-Filtra la sintaxis de marcado antes de la síntesis.

Información útil

La entrada máxima es de 1.000 caracteres. Soporta identificadores de voz oficiales, voces clonadas personalizadas, etiquetas de emociones voice_label y etiquetas de estilo voice_label. El parámetro de instrucción es solo para stepaudio-2.5-tts.

API de Step TTS 2: preguntas frecuentes

¿Cuánto cuesta la API de Step TTS 2?

En EmpirioLabs, Step TTS 2 se factura por uso: Síntesis $0.40 por cada 10.000 caracteres. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.

¿Qué endpoint usa Step TTS 2?

Step TTS 2 se sirve a través de POST /v1/audio/speech en api.empiriolabs.ai con autenticación estándar de token Bearer.

¿Puedo probar Step TTS 2 en el navegador antes de integrar?

Sí. El playground de EmpirioLabs ejecuta Step TTS 2 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.

¿Cómo consigo una clave de API de Step TTS 2?

Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.