Skip to main content
POST
  • 模型名称固定为 MiniMax-H3
  • 支持文生视频、首帧/尾帧图生视频,以及图片、视频、音频联合参考生成
  • 输出分辨率固定为 2K,时长支持 4-15
  • 异步任务接口,提交后返回统一的 generation.task
请优先传入公网可访问的素材 URL。首尾帧模式与多模态参考模式互斥;参考音频不能单独使用,必须同时提供至少一张参考图或一段参考视频。

认证

string
必填
所有接口均需要使用 Bearer Token 认证。

请求参数

string
默认值:"MiniMax-H3"
必填
视频生成模型名称,固定为 MiniMax-H3
string
必填
视频内容描述,最多 7000 个字符。建议明确描述主体、动作、场景、镜头、风格和声音要求。
integer
默认值:5
输出视频时长,支持 4-15 秒的整数值。
string
默认值:"2K"
输出视频分辨率,当前仅支持 2K
string
默认值:"16:9"
输出视频宽高比。可选值:21:916:94:31:13:49:16adaptive
  • 文生视频:默认 16:9,不能使用 adaptive
  • 首帧/尾帧模式:始终按输入图片自适应,传入的具体比例会被忽略
  • 多模态参考模式:默认 adaptive,也可指定具体比例
string[]
兼容模式下的图片 URL 数组。新接入建议优先使用 image_with_roles 明确图片用途。
  • 1 张图片:作为 first_frame
  • 2 张图片:依次作为 first_framelast_frame
  • 3-9 张图片:作为 reference_image
不要同时传入 image_urlsimage_with_roles,否则图片用途可能产生歧义。
array
带角色的图片数组。
array
多模态参考模式下的视频数组,最多 3 段。
ToAPIs 会读取参考视频的实际时长用于计费,请勿提交客户端计算的时长字段。
array
多模态参考模式下的音频数组,最多 3 段。
参考音频不能单独使用,必须同时传入至少一项 reference_imagereference_video
boolean
默认值:false
是否在生成视频中添加 AIGC 标识水印。
string
客户侧业务 ID,例如订单号或流水号。提交后可使用同一状态接口按该 ID 查询任务。
string
ToAPIs 标准任务完成回调地址。需先配置 Token URL 和签名密钥;详见 任务 Webhook

输入模式

多模态参考限制:
  • 参考图最多 9
  • 参考视频最多 3
  • 参考音频最多 3
  • 图片、视频、音频合计最多 12 个文件
  • 首尾帧角色不能与任意参考角色混用

请求示例

文生视频

首尾帧图生视频

多参考图生成

视频与音频联合参考

响应

string
ToAPIs 任务 ID,用于查询任务状态。
string
对象类型,固定为 generation.task
string
本次请求使用的模型名称,固定为 MiniMax-H3
string
任务状态:queuedin_progresscompletedfailed
integer
任务进度百分比,范围 0-100
integer
任务创建时间的 Unix 时间戳(秒)。
提交成功后,使用 获取视频任务状态 轮询。任务完成时,视频 URL 位于 result.data[0].url