Pixverse Lip Sync API

将现有视频中的口型动作与上传的音轨或十四个内置语音中的文本对齐。

PixVerse视频生成发布日期 2025年7月14日专有端点

关于 Pixverse Lip Sync

将现有视频中的口型动作与上传的音轨或十四个内置语音中的文本对齐。

lipsyncaudio invideo editing

Pixverse Lip Sync 规格

模型 ID
pixverse-lipsync
开发方
PixVerse
类别
视频生成
发布日期
2025年7月14日
输入
文本视频音频
输出
视频
端点
POST/v1/videos/generations
备用模型 ID
pixverse/lipsync

Pixverse Lip Sync API 价格

来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。

类型
规格
价格
演讲
每秒
$0.020444
在完整价格页比较

如何调用 Pixverse Lip Sync API

Pixverse Lip Sync 通过 POST /v1/videos/generations 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 在EmpirioLabs 控制台获取 API 密钥。

cURL:提交任务
curl https://api.empiriolabs.ai/v1/videos/generations \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "pixverse-lipsync",
    "prompt": "Describe what you want Pixverse Lip Sync to generate."
  }'
cURL:轮询结果
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/videos/generations",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "pixverse-lipsync",
        "prompt": "Describe what you want Pixverse Lip Sync to generate.",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Pixverse Lip Sync API 完整参考

Pixverse Lip Sync API 参数

EmpirioLabs 上 Pixverse Lip Sync API 支持的请求参数。省略字段时使用默认值。

参数类型默认值范围 / 值描述
lip_sync_tts_contentstring--发言的队伍。当没有附加音频文件时使用。以15字符的块形式计费。
lip_sync_tts_speaker_idenumAutoAuto, Emily, James, Isabella, Liam, Chloe, Adrian, Harper, Av...语音用于台词。自动选择一个适合弹夹的。当音频文件附加时,会被忽略。
videostring--视频来源网址。必须。
audiostring--用于对口型的音频网址。优先于口头文字。

须知

将现有视频中的口部动作与语音对齐,无论是来自你提供的音频文件,还是内置语音的文本。输入 - video:源剪辑,最长300秒,250MB。- audio:语音匹配,最长300秒,250MB。- 或者lip_sync_tts_contentlip_sync_tts_speaker_id让模特说你的台词。共有十四个有名字的配音,外加Auto,可以根据片段选择一个合适的配音。计费 - 按每秒语音计费。文本转语音输入以15字符块计量,速率相同,因此充电追踪的是脚本长度,而非源视频长度。输入限制 - 视频:MP4、MOV或WebM,长边最高1920px。- 音频:MP3、WAV、M4A 或 AAC。

Pixverse Lip Sync API:常见问题

Pixverse Lip Sync API 收费多少?

在 EmpirioLabs,Pixverse Lip Sync 按量计费:演讲 $0.020444 每秒。本页的实时价格表始终与 API 的实际计费一致。

Pixverse Lip Sync 使用哪个端点?

Pixverse Lip Sync 通过 api.empiriolabs.ai 上的 POST /v1/videos/generations 提供,使用标准的 Bearer 令牌认证。

集成之前可以在浏览器里试用 Pixverse Lip Sync 吗?

可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Pixverse Lip Sync,你可以在写代码之前先测试提示词。

如何获取 Pixverse Lip Sync API 密钥?

创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。