MiniMax H3 已在 EmpirioLabs 上提供。 它是一种多模态视频模型,能够在一次请求中接收文本、图片、视频和音频,并返回一段4到15秒、24帧/秒、768p或2K的片段,每个片段都带有原生立体声音轨。
四种驾驶方式
H3 是一个具有 模式 这个参数是你附加的自动检测的,所以大多数请求根本不需要设置它。
- 文本转视频:一个独立的提示。
- 图像到视频:其中一张图像成为开场画面。
- 第一帧和最后一帧:提供开口和闭合图像,模型在它们之间切换。
- 视频参考最多9张图片、3段视频和3段音频片段,共12个参考文件,用以贯穿整个镜头的主题或风格。
提示词可达7000字符,描述动作、摄影、对话、音效和屏幕文本。宽高比可以明确设置或保持自适应,使其跟随输入媒体。
如何称呼MiniMax H3
视频生成是异步的。提交任务,然后轮询:
curl https://api.empiriolabs.ai/v1/videos/generations \ -h '授权:承载者 $EMPIRIOLABS_API_KEY' \ -h '内容类型:application/json' \ -d '{ “model”: “minimax-h3”, “提示”:“一盏灯笼在黄昏时分漂过安静的港口,缓缓推进,远处海鸥鸣叫。”, “持续时间”: 6, “分辨率”: “768p”, “aspect_ratio”: “16:9” }'
回复返回 a 任务(d) (单位:千美元) 民调url.投票 快/v1/jobs/{job_id} 直到状态为 已完成,而完成的剪辑作为 的投递 URL 到达 data[0].url。 。 。.
要对已有图像进行动画,请添加 图像.要在两个帧之间切换,请添加 last_frame 同样如此。要让一个主体穿越场景,请在下面发送多张图片 图片。 。 。.
定价
H3按你要求的分辨率按每秒视频计费,2K价格超过768p。在你制作之前,有两个细节值得了解:
- 一个参考 视频 它按自身时长计费,且是你生成的片段,所以用来制作6秒片段的5秒参考计费是11秒。
- 前五号引用 图片 包含在内,且每个额外的参考图像单独计费。
开始建造
试试MiniMax H3 游戏场,阅读 API 文档,或者将其与其他模型进行比较 型号目录。 。 。.
披露:这篇文章是在AI的协助下撰写的,并由EmpirioLabs AI审查.



