Modelos de geração de fala, música e som em uma API unificada.
Modelos de geração de áudio em EmpirioLabs cobrem text-to-speech, música e efeitos sonoros, com opções como múltiplos alto-falantes ou clonagem de voz, dependendo do modelo. Você envia sua mensagem ou prompt e recupera o áudio, cobrado por geração ou por minuto.
ACE-Step 1.5 XL roda por POST /v1/audio/generations. A requisição retorna um job_id na hora; consulte GET /v1/jobs/{job_id} até o job terminar e leia as URLs de saída do resultado. Troque o id model por qualquer modelo acima. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate."
}'A EmpirioLabs lista 15 APIs de modelos de Geração de Áudio, incluindo ACE-Step 1.5 XL, TTS 2, TTS 1.5 Mini. Cada modelo tem sua própria página de API com preços ao vivo, parâmetros e um quickstart.
Cada modelo de Geração de Áudio é cobrado por uso, sem mínimo mensal. A tabela de tarifas exata fica na página de cada modelo e sempre corresponde ao que a API cobra.
Não. Todo modelo aqui roda no playground da EmpirioLabs, uma interface amigável no navegador onde você ajusta as opções e vê resultados sem escrever código. Quando quiser automatizar, o mesmo modelo está disponível pela API.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.