
기존 영상의 입 움직임을 업로드된 오디오 트랙이나 14개의 내장 음성 중 하나가 말하는 텍스트와 정렬합니다.
기존 영상의 입 움직임을 업로드된 오디오 트랙이나 14개의 내장 음성 중 하나가 말하는 텍스트와 정렬합니다.
pixverse-lipsync/v1/videos/generationspixverse/lipsyncEmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Pixverse Lip Sync은(는) POST /v1/videos/generations로 실행됩니다. 요청은 즉시 job_id를 반환하며, 작업이 완료될 때까지 GET /v1/jobs/{job_id}을 폴링한 뒤 결과에서 출력 URL을 읽으세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "pixverse-lipsync",
"prompt": "Describe what you want Pixverse Lip Sync to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "pixverse-lipsync",
"prompt": "Describe what you want Pixverse Lip Sync to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs에서 Pixverse Lip Sync API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| lip_sync_tts_content | string | - | - | 말할 줄. 오디오 파일이 첨부되지 않았을 때 사용됩니다. 15자 블록으로 표기됩니다. |
| lip_sync_tts_speaker_id | enum | Auto | Auto, Emily, James, Isabella, Liam, Chloe, Adrian, Harper, Av... | 대사에 사용된 목소리. 자동 선택은 클립에 맞는 하나를 선택합니다. 오디오 파일이 첨부되면 무시됩니다. |
| video | string | - | - | 원본 영상 URL. 필수입니다. |
| audio | string | - | - | 립싱크할 오디오 URL. 말하는 텍스트보다 우선합니다. |
기존 영상의 입 움직임을 음성 메시지와 일치시키며, 제공한 오디오 파일이나 내장 음성으로 말하는 텍스트와 일치시킵니다. 입력 입력 - video: 소스 클립, 최대 300초 및 250MB. - audio: 최대 300초 250MB의 연설 - 아니면 lip_sync_tts_speaker_id 모델이 네 말을 말하게 lip_sync_tts_content. 14명의 이름 있는 목소리와 Auto 목소리가 있으며, 클립에 맞는 목소리를 선택할 수 있습니다. 청구 - 말의 초당 청구. 텍스트 음성 입력은 동일한 속도로 15자 블록으로 측정되므로, 이 요금은 원본 영상 길이가 아니라 스크립트의 길이를 추적합니다. 입력 제한 - 비디오: MP4, MOV 또는 WebM, 긴 가장자리에서 최대 1920px. - 오디오: MP3, WAV, M4A 또는 AAC.
EmpirioLabs에서 Pixverse Lip Sync은(는) 종량제로 청구됩니다: 연설 $0.020444 초당. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Pixverse Lip Sync은(는) api.empiriolabs.ai의 POST /v1/videos/generations를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Pixverse Lip Sync을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.