
既存の動画の口の動きをアップロードされた音声トラックや、14の内蔵音声のいずれかが話すテキストに同期させます。
既存の動画の口の動きをアップロードされた音声トラックや、14の内蔵音声のいずれかが話すテキストに同期させます。
pixverse-lipsync/v1/videos/generationspixverse/lipsyncEmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
Pixverse Lip Sync は POST /v1/videos/generations で動作します。リクエストはすぐに job_id を返すので、ジョブが完了するまで GET /v1/jobs/{job_id} をポーリングし、結果から出力 URL を読み取ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "pixverse-lipsync",
"prompt": "Describe what you want Pixverse Lip Sync to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "pixverse-lipsync",
"prompt": "Describe what you want Pixverse Lip Sync to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上の Pixverse Lip Sync API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| lip_sync_tts_content | string | - | - | 話すためのライン。音声ファイルが添付されていない場合に使われます。15文字ブロックで表記されています。 |
| lip_sync_tts_speaker_id | enum | Auto | Auto, Emily, James, Isabella, Liam, Chloe, Adrian, Harper, Av... | セリフで使われた声。自動でクリップに合うものを選びます。音声ファイルが添付されているときは無視されます。 |
| video | string | - | - | 出典動画URL。必須。 |
| audio | string | - | - | リップシンク用の音声URL。話されたテキストよりも優先されます。 |
既存の動画の口の動きを音声に合わせます。提供した音声ファイルや内蔵音声によるテキストからです。入力 - video:ソースクリップ、最大300秒、250MB。- audio:最大300秒、250MBまでの音声。- あるいはlip_sync_tts_speaker_idとlip_sync_tts_contentしてモデルにテキストを話してもらう。14の名声に加えAuto声が用意されており、クリップに合う声を選びます。請求 - 1秒単位で請求されます。テキスト読み上げ入力は同じ速度で15文字ブロック単位で計測されるため、充電は元の動画の長さではなくスクリプトの長さを追跡します。入力制限 - ビデオ:MP4、MOV、またはWebM、長辺で最大1920ピクセル。- 音声:MP3、WAV、M4A、またはAAC。
EmpirioLabs では Pixverse Lip Sync は従量課金です: 演説 $0.020444 秒単位。このページのライブ料金表は常に API の請求額と一致します。
Pixverse Lip Sync は api.empiriolabs.ai 上の POST /v1/videos/generations で提供され、標準的な Bearer トークン認証を使用します。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Pixverse Lip Sync をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。