可生成4至15秒的片段,最高可达2K,支持原生立体声音频,同时在一次请求中跟随文本、图像、视频和音频引用。
minimax-h3/v1/videos/generationsminimax/minimax-h3hailuo-3minimax/hailuo-3来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
MiniMax H3 通过 POST /v1/videos/generations 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3",
"prompt": "Describe what you want MiniMax H3 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "minimax-h3",
"prompt": "Describe what you want MiniMax H3 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上 MiniMax H3 API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| prompt | string | - | - | 场景描述,最多7000字符。可以描述动作、摄影、对话、音效和屏幕文字。 |
| mode | enum | auto | auto, t2v, i2v, flf, r2v, regenerate | 自动:从输入端检测。T2V:text-to-video。i2V:将一张图片作为开场帧动画。FLF:从第一帧过渡到最后一帧。R2V:从图片、视频和音频reference-to-video。再生:从该模型以2K分辨率重新渲染一段768p片段。 |
| resolution | enum | 768p | 768p, 2k | 输出分辨率。2K的每秒计费率高于768p。 |
| aspect_ratio | enum | adaptive | adaptive, 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 | 输出宽高比。自适应模式遵循提供的输入介质。 |
| duration | number | 6 | 4 到 15 | 剪辑长度以秒计,仅限整数。 |
| image | string | - | - | 图片网址。image-to-video开场一帧,reference-to-video最多9张参考图片。 |
| last_frame | string | - | - | 关闭帧图片URL。提供时选择第一帧和最后帧模式。 |
| video | string | - | - | 参考视频网址,最多3个2至15秒的片段。参考视频除了生成的片段外,还按其自身时长计费。 |
| audio | string | - | - | 参考音频网址,最多3段2至15秒的片段。需要附带参考图片或视频。 |
| base_video | string | - | - | 该型号之前生成的768p剪辑,重新渲染为2K。提供该版本时选择再生,该再生在源剪辑和输出上按较低的每秒速率计费。 |
| watermark | boolean | false | - | 在输出中添加AI生成内容的水印。 |
| enhance_prompt | boolean | false | - | 在渲染前将你的任务扩展成完整的提示词,添加镜头结构、摄影和音景。你附加的任何参考媒体都会为扩展提供信息。在每秒视频成本之外,还会额外收取每个代币的费用。 |
MiniMax H3 生成 4 到 15 秒的 24 fps 768p 或 2K 视频,每个片段带有原生立体声音轨。模式- 文本转视频:仅提示词。- 图像转视频:一张图片成为开场帧。- 第一帧和最后一帧:提供开头和结尾图像。- 视频参考:最多 9 张图片,3 个视频和 3 个音频剪辑,共 12 个参考文件。- 再生:重新渲染你之前生成的 2K 768p 片段。发送原始提示词和源片段作为base_video。提示扩展 将 enhance_prompt 设为 true,模型先将你的简报重写成完整提示词,添加shot-by-shot结构、摄像机移动、光影和音景,然后从中渲染。你附加的任何参考媒体都会为扩展提供信息。它在每秒视频成本基础上增加每个令牌的费用,且在再生时跳过,因为该路径会重现原始请求。参考媒体- 图片每边256至5760像素,宽高比在0.4至2.5之间,最高30 MB。- 2至15秒的视频,H.264或H.265,每个最高50 MB。- 音频2至15秒,WAV或MP3,每个最高15 MB。参考音频需要附带图像或视频参考。- 参考视频和音频仅适用于reference-to-video。- 提示可达7000字符,可能描述对话、音效、屏幕文本和摄影。计费 - 按您要求的分辨率按生成片段的每秒计费。- 参考视频除了生成的片段外,还按其自身时长计费,因此用于制作6秒片段的5秒参考计费为11秒。- 再生按自身较低的每秒速率计费,基于源片段时长加上重生成输出。从原始请求带入的参考图像不会重新计费。- 前5张参考图像被包含。每个额外的参考图像单独计费。- 提示扩展(启用时)按令牌计费。
在 EmpirioLabs,MiniMax H3 按量计费:768p $0.18 每秒; 2K $0.26 每秒; 2K 再生 $0.10 每秒; 参考图像输入 $0.08 前5张之后的每张输入图像; 提示扩展输入 $1.80 每100万个提示词标记; 提示展开输出 $7.20 每100万个生成代币。本页的实时价格表始终与 API 的实际计费一致。
MiniMax H3 通过 api.empiriolabs.ai 上的 POST /v1/videos/generations 提供,使用标准的 Bearer 令牌认证。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 MiniMax H3,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。