
프레임 동기화된 사운드트랙은 영상에서 직접 생성되거나 텍스트 프롬프트에서 음악을 생성하며, 세그먼트별 방향과 스템 분리가 적용되었습니다.
프레임 동기화된 사운드트랙은 영상에서 직접 생성되거나 텍스트 프롬프트에서 음악을 생성하며, 세그먼트별 방향과 스템 분리가 적용되었습니다.
sonilo-v1-1/v1/audio/generationssonilo-v1.1sonilo/v1.1sonilo-musicsonilo/sonilo-v1-1EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Sonilo v1.1은(는) POST /v1/audio/generations로 실행됩니다. 요청은 즉시 job_id를 반환하며, 작업이 완료될 때까지 GET /v1/jobs/{job_id}을 폴링한 뒤 결과에서 출력 URL을 읽으세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "sonilo-v1-1",
"prompt": "Describe what you want Sonilo v1.1 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "sonilo-v1-1",
"prompt": "Describe what you want Sonilo v1.1 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs에서 Sonilo v1.1 API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| prompt | string | - | - | 음악에 대한 스타일 또는 창의적 방향. 텍스트만으로 생성할 때 필수. 영상 음악 작업에서는 영상이 이끄는 경우 선택 사항입니다. |
| mode | enum | auto | auto, text, video | 첨부된 영상을 자동으로 점수 매기고, 영상이 없을 때는 텍스트 음악 전환으로 전환합니다. 텍스트나 영상을 설정해 행동을 고정하세요. |
| duration | number | - | 5 ~ 360 | 트랙 길이는 초 단위로 표시됩니다. 텍스트 모드만 가능합니다. 비디오 모드에서는 트랙이 원본 영상 길이를 따라갑니다. 프롬프트가 결정하도록 비워두세요. |
| output_format | enum | m4a | m4a, wav, mp3 | 전달된 오디오 포맷입니다. m4a는 AAC, wav는 16비트 PCM, mp3는 320kbps입니다. |
| variants_num | number | 1 | 1 ~ 10 | 한 번의 요청에서 몇 개의 서로 다른 음악 지시를 생성해야 하는지. 각 변형은 초당 요금으로 별도로 청구되며, 최소 10초 단위가 적용된다. |
| stems | boolean | false | - | 또한 생성된 트랙을 드럼, 베이스, 보컬, 기타 등으로 나누어 반환하세요. 요금이 추가되지 않고 대기 시간이 몇 분 더 늘어납니다. |
| ducking | boolean | false | - | 또한 대사가 이해하기 좋도록 음악 대신 원본 영상의 대사 아래에 담근 테이크를 반품하세요. 비용이 전혀 없습니다. |
| preserve_speech | boolean | false | - | 원본 영상의 대사는 그대로 유지하고, 음악과 함께 분리된 목소리와 믹스 트랙을 반환하세요. |
| prompt_influence | number | 0.5 | 0 ~ 1 | 음악이 영상보다 프롬프트를 얼마나 강하게 따르는지. 낮은 음은 영상이 리드하는 것이고, 높은 음은 프롬프트를 더 문자 그대로 따르는 것입니다. 요금이 추가되지 않습니다. |
| segments | string | - | - | 장면별 방향에 맞는 타이밍 세그먼트 프롬프트의 JSON 배열입니다. 각 항목은 시작, 종료, 프롬프트를 초 단위로 처리합니다. |
| video_url | string | - | - | 공개적으로 접근 가능한 URL로 점수를 받을 영상을 소스로 설정하세요. 최대 300MB와 6분까지. playground에 영상을 업로드하면 이 설정이 가능합니다. |
모드 - 첨부된 영상에 자동 점수를 부여하고, 영상이 없을 때는 텍스트와 음악으로 전환 - 비디오 모드는 원본 영상의 컷과 템포를 따릅니다 - 텍스트 모드는 프롬프트만으로 생성됩니다 컨트롤 프롬프트, 모드, 소스 비디오, 텍스트 모드에서 5초에서 360초 길이, m4a, wav 또는 mp3 출력, 1에서 10가지 변형, 스템 분리, 숙임, 음성 보존, 프롬프트 영향, JSON 세그먼트 프롬프트 지원 제한 - 소스 비디오 최대 300MB 및 6분 - 텍스트 모드에서 5초에서 360초 길이. 비디오 모드는 소스 길이에 따라 - 숙이기, 음성 보존 및 프롬프트 영향은 비디오 모드에만 적용됩니다 청구 - 카탈로그 요금으로 생성된 초당 요금이 부과되며, 트랙당 최소 10초입니다. 4초 트랙은 10초에 청구됩니다. - 각 변형은 별도로 청구되며, 최소 10초 기준이 적용됩니다. - 스템 분리, 숙임, 즉각적인 영향은 요금을 추가하지 않습니다. - 생성 전에 거부된 요청은 청구되지 않습니다.
EmpirioLabs에서 Sonilo v1.1은(는) 종량제로 청구됩니다: 텍스트와 음악 $0.0045 생성된 초당; 비디오와 음악으로 $0.018 생성된 초당. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Sonilo v1.1은(는) api.empiriolabs.ai의 POST /v1/audio/generations를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Sonilo v1.1을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.