단일 초상화를 업로드된 오디오 트랙이나 내장 음성 텍스트로 구동되는 말하는 아바타 영상으로 변환합니다.
단일 초상화를 업로드된 오디오 트랙이나 내장 음성 텍스트로 구동되는 말하는 아바타 영상으로 변환합니다.
pixverse-avatar/v1/videos/generationspixverse/avatarEmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Pixverse Avatar은(는) POST /v1/videos/generations로 실행됩니다. 요청은 즉시 job_id를 반환하며, 작업이 완료될 때까지 GET /v1/jobs/{job_id}을 폴링한 뒤 결과에서 출력 URL을 읽으세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "pixverse-avatar",
"prompt": "Describe what you want Pixverse Avatar to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "pixverse-avatar",
"prompt": "Describe what you want Pixverse Avatar to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs에서 Pixverse Avatar API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| lip_sync_tts_content | string | - | - | 아바타가 말하는 대사. 오디오 파일이 첨부되지 않았을 때 사용됩니다. 15자 블록으로 표기됩니다. |
| lip_sync_tts_speaker_id | enum | Auto | Auto, Emily, James, Isabella, Liam, Chloe, Adrian, Harper, Av... | 대사에 사용된 목소리. 자동으로 초상화에 맞는 하나를 선택합니다. 오디오 파일이 첨부되면 무시됩니다. |
| resolution | enum | 720p | 360p, 540p, 720p, 1080p | 출력 해상도. 해상도가 높은 화질은 초당 요금이 더 높습니다. |
| prompt | string | - | - | 전달 또는 액자 배치에 대한 선택적 지시. |
| image | string | - | - | 세로 이미지 URL. 필수입니다. |
| audio | string | - | - | 아바타가 연기할 오디오 URL. 말하는 텍스트보다 우선합니다. |
단일 초상 이미지를 음성 파일이나 내장 음성으로 전달하는 음성 아바타 비디오로 변환합니다. 입력 - image: 애니메이션을 위한 초상화. 명확하고 정면을 향한 피사체를 사용하세요. - audio: 모델이 당신의 텍스트를 말하도록 lip_sync_tts_content lip_sync_tts_speaker_id 연설 또는. 14명의 이름 있는 목소리와 Auto 음성이 제공됩니다. - prompt는 선택 사항이며 전달이나 프레이밍을 설명할 수 있습니다. 출력 - 360p, 540p, 720p, 1080p. 청구 - 출력 해상도에 따라 초당 요금으로 청구됩니다. 텍스트-음성 입력은 동일한 속도로 15자 블록으로 측정되므로, 전하가 스크립트 길이를 추적합니다. 입력 제한 - 이미지: PNG, JPEG 또는 WebP, 최대 20MB와 긴 가장자리에 10000px. - 오디오: MP3, WAV, M4A 또는 AAC.
EmpirioLabs에서 Pixverse Avatar은(는) 종량제로 청구됩니다: 360p $0.025556 초당; 540p $0.051111 초당; 720p $0.076667 초당; 1080p $0.102222 초당. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Pixverse Avatar은(는) api.empiriolabs.ai의 POST /v1/videos/generations를 통해 제공되며 표준 Bearer 토큰 인증을 사용합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Pixverse Avatar을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.