
텍스트 프롬프트에서 최대 3 분의 오디오를 생성, text-to-audio 및 audio-to-audio 조정 가능한 기간, 단계 및 CFG 스케일을 지원.
텍스트 프롬프트에서 최대 3 분의 오디오를 생성, text-to-audio 및 audio-to-audio 조정 가능한 기간, 단계 및 CFG 스케일을 지원.
다른 이름 Stable Audio, Stability AI Stable Audio 2.0, Stable-Audio-2.0, stable-audio-2-0
stable-audio-2-0/v1/audio/generationsstability-audio-2.0stability/audio-2.0EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Stable Audio 2.0은(는) POST /v1/audio/generations로 실행됩니다. 요청은 즉시 job_id를 반환하며, 작업이 완료될 때까지 GET /v1/jobs/{job_id}을 폴링한 뒤 결과에서 출력 URL을 읽으세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs에서 Stable Audio 2.0 API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| prompt | string | - | - | 무엇을 생성할지. 장르, 악기, 분위기, 템포에 대해 구체적으로 말하세요. |
| mode | enum | text-to-audio | text-to-audio, audio-to-audio | text-to-audio: 프롬프트에서만 생성하세요. audio-to-audio: 참고 영상에 대한 조건. |
| output_format | enum | mp3 | mp3, wav | 출력 미디어 파일 형식(엔드포인트에 따라 mp3, wav, mp4, png, jpg 등)을 선택할 수 있습니다. |
| duration | number | 190 | 1 ~ 190 | 몇 초. Stability Audio 2.0은 최대 3분 10초를 생성합니다. |
| steps | number | 50 | 30 ~ 100 | 확산 단계. More = 더 높은 정확도, 느리게(그리고 한 걸음당 크레딧이 추가됨). |
| cfg_scale | number | 7 | 1 ~ 25 | 분류기 없는 안내. 더 높은 = 프롬프트를 더 엄격하게 따르는 것. |
| strength | number | 1 | 0 ~ 1 | 오디오-오디오만 가능합니다. 0 = 참조 무시, 1 = 참조 근처에 머무르기. |
| random_seed | boolean | true | - | 만약 맞다면, 매번 무작위 시드를 사용하세요. |
| seed | number | - | - | 재현성 시드. random_seed=false 때만 사용됩니다. |
| audio_url | string | - | - | audio-to-audio 모드에 대한 오디오 URL을 참고하세요. |
텍스트 또는 audio-to-audio 변환을 통해 최대 3분의 오디오를 생성합니다. Audio-to-audio 모드 - BOTH를 신속하고 업로드 된 오디오 파일 - 권장 CFG 스케일: 7-15 - 권장 단계: 6-8 - 전형적인 강도: 0.3-0.7
EmpirioLabs에서 Stable Audio 2.0은(는) 종량제로 청구됩니다: 기본 비용 $0.58 1세대; 단계 비용 $0.00 단계 당. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Stable Audio 2.0은(는) api.empiriolabs.ai의 POST /v1/audio/generations를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Stable Audio 2.0을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.