Step TTS 2 API

StepFun text-to-speech modelo com vozes oficiais, vozes clonadas personalizadas e controles de tag de voz.

StepFunGeração de ÁudioInternationalEndpoint proprietárioNovo

Sobre Step TTS 2

StepFun text-to-speech modelo com vozes oficiais, vozes clonadas personalizadas e controles de tag de voz.

A contagem de caracteres segue o preço do StepFun: um caractere chinês conta como um caractere, duas letras inglesas contam como um caractere, e dois sinais de pontuação contam como um caractere.

Também conhecido como StepFun Step TTS 2, Step-TTS-2

text to speechvoice tagsmultilingual

Especificações de Step TTS 2

ID do modelo
step-tts-2
Provedor
StepFun
Categoria
Geração de Áudio
Lançado
-
Entrada
Texto
Saída
Áudio
Região
International
Endpoints
POST/v1/audio/speech
IDs de modelo alternativos
stepfun/step-tts-2

Preços da API Step TTS 2

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Síntese
por 10.000 caracteres
$0.40
Comparar na página completa de preços

Como chamar a API Step TTS 2

Step TTS 2 gera fala por POST /v1/audio/speech e retorna áudio reproduzível. Envie o texto a ser falado em input com o id de modelo step-tts-2. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "step-tts-2",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "step-tts-2", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
Referência completa da API Step TTS 2

Parâmetros da API Step TTS 2

Parâmetros de requisição suportados pela API Step TTS 2 na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
inputstring-máx. 1000Texto para sintetizar. No máximo 1.000 caracteres.
voiceenumlively-girllively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v...Official StepFun voice. Custom cloned voice IDs are also accepted via the API.
response_formatenummp3mp3, wav, flac, opus, pcmFormato de áudio de saída.
speednumber10.5 a 2Velocidade da fala.
volumenumber10.1 a 2Volume de saída.
sample_rateenum240008000, 16000, 22050, 24000Taxa de amostragem de saída em Hz.
voice_labelobject--Tags de emoção e estilo de fala para step-tts-2.
pronunciation_mapobject--Mapeamento opcional de pronúncia.
markdown_filterbooleanfalse-Filtre a sintaxe de markdown antes da síntese.

Bom saber

A entrada máxima é de 1.000 caracteres. Suporta identificações de voz oficiais, vozes clonadas personalizadas, tags de emoção voice_label e tags de estilo voice_label. O parâmetro de instrução é apenas para stepaudio-2.5-tts.

API Step TTS 2: perguntas frequentes

Quanto custa a API Step TTS 2?

Na EmpirioLabs, Step TTS 2 é cobrado por uso: Síntese $0.40 por 10.000 caracteres. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual endpoint Step TTS 2 usa?

Step TTS 2 é servido por POST /v1/audio/speech em api.empiriolabs.ai com autenticação padrão por token Bearer.

Posso testar Step TTS 2 no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa Step TTS 2 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API Step TTS 2?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.