
Gera áudio até 3 minutos das instruções de texto, suportando text-to-audio e audio-to-audio com duração ajustável, etapas e escala CFG.
Gera áudio até 3 minutos das instruções de texto, suportando text-to-audio e audio-to-audio com duração ajustável, etapas e escala CFG.
Também conhecido como Stable Audio, Stability AI Stable Audio 2.0, Stable-Audio-2.0, stable-audio-2-0
stable-audio-2-0/v1/audio/generationsstability-audio-2.0stability/audio-2.0Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Stable Audio 2.0 roda por POST /v1/audio/generations. A requisição retorna um job_id na hora; consulte GET /v1/jobs/{job_id} até o job terminar e leia as URLs de saída do resultado. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parâmetros de requisição suportados pela API Stable Audio 2.0 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| prompt | string | - | - | O que gerar. Seja específico sobre gênero, instrumentos, clima e andamento. |
| mode | enum | text-to-audio | text-to-audio, audio-to-audio | text-to-audio: gerar apenas a partir do prompt. audio-to-audio: condição em um clipe de referência. |
| output_format | enum | mp3 | mp3, wav | Formato de arquivo de mídia de saída (mp3, wav, mp4, png, jpg, etc., dependendo do endpoint). |
| duration | number | 190 | 1 a 190 | Segundos. Stability Audio 2.0 gera até 3 minutos e 10 segundos. |
| steps | number | 50 | 30 a 100 | Etapas de difusão. Mais = maior fidelidade, mais lento (e adiciona créditos por passo). |
| cfg_scale | number | 7 | 1 a 25 | Orientação sem classificadores. Maior = segue o prompt de forma mais rigorosa. |
| strength | number | 1 | 0 a 1 | Apenas áudio para áudio. 0 = ignorar referência, 1 = ficar próximo da referência. |
| random_seed | boolean | true | - | Se for verdade, use uma seed aleatória a cada chamada. |
| seed | number | - | - | Semente de reprodutibilidade. Usado apenas quando random_seed=falso. |
| audio_url | string | - | - | Consulte a URL de áudio para o modo audio-to-audio. |
Gera até 3 minutos de áudio do texto ou através de audio-to-audio transformação. Modo Audio-to-audio - Requer um prompt e um arquivo de áudio carregado - Escala CFG recomendada: 7-15 - Passos recomendados: 6-8 - Força típica: 0.3-0.7
Na EmpirioLabs, Stable Audio 2.0 é cobrado por uso: Custo base $0.58 por geração; Por Custo Passo $0.00 por etapa. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Stable Audio 2.0 é servido por POST /v1/audio/generations em api.empiriolabs.ai com autenticação padrão por token Bearer.
Sim. O playground da EmpirioLabs executa Stable Audio 2.0 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.