模型 API视频生成
MiniMax H3 四种视频模式
文生视频、图生视频、首尾帧和全能参考采用不同的素材合同。
先选择模式
H3 通过 POST /media/generations 创建视频任务。公开模型别名以 Portal 详情为准;不要使用服务实例 ID。
| 模式 | generationMode | 输入 |
|---|---|---|
| 文生视频 | t2v | 提示词,不传素材 |
| 图生视频 | i2v | input_image_asset_id |
| 首尾帧 | first_last_frame_video | input_image_asset_id 和 end_image_asset_id |
| 全能参考 | universal_reference_video | 有序 referenceInputs,至少一张图片或一个视频 |
当前 H3 合同以 768p、横/竖屏、5–15 秒整数时长、24 FPS 音画同步 MP4 为基础。合法组合与输入上限仍应读取当前模型详情;不要传任意像素、内部帧数、采样步数或插帧参数。
创建请求
先按 快速开始 设置三个环境变量。将下列 JSON 保存为 request.json,替换 model。相同业务请求使用稳定的幂等键。
{
"model":"<MODEL_ALIAS>",
"generationMode":"t2v",
"prompt":"雨后街道,镜头缓慢前移,人物撑伞走过,保留自然雨声",
"resolutionTier":"768p",
"orientation":"landscape",
"seconds":5
}curl --fail-with-body --max-time 60 "$JUSP_BASE_URL/media/generations" \
-H "Authorization: Bearer $JUSP_API_KEY" \
-H 'Content-Type: application/json' \
-H 'Idempotency-Key: your-stable-business-request-id' \
--data-binary @request.json --output create.json图生视频在上例中改 generationMode 并增加首图资产 ID。首尾帧再增加 end_image_asset_id;两张图均需提前上传,不把本地路径放进 JSON。
全能参考
以下结构替换 t2v 的模式,并加入 referenceInputs:
{
"generationMode":"universal_reference_video",
"referenceInputs":[
{"role":"reference_image","mediaType":"image","assetId":"<IMAGE_ASSET_ID>"},
{"role":"reference_video","mediaType":"video","assetId":"<VIDEO_ASSET_ID>"},
{"role":"reference_audio","mediaType":"audio","assetId":"<AUDIO_ASSET_ID>"}
]
}该代码块是要合入完整请求的片段,不是独立请求。参考顺序有意义:图片、视频、音频分别有序,不重复同一个素材。提示词可明确每项素材的用途。
| 限制 | 当前合同 |
|---|---|
| 图片 | 0–9 张;存在视频时最多 8 张 |
| 视频 | 0–1 个 |
| 音频 | 0–3 段,每段 2–15 秒,总时长不超过 15 秒 |
| 总数 | 不超过 12;至少一个视觉素材 |
| 提示词 | 不超过 7000 个字符 |
全能参考图片单张不超过 30 MiB,视频不超过 50 MiB,音频不超过 15 MiB;首尾帧图片使用另一套限制。像素、格式、时长等完整约束以服务详情为准。MOV 音频参考必须按 audio 上传身份处理。
是否使用智能优化
当前服务推荐优化时,可以先调用 提示词优化,展示结果供用户编辑,再决定是否生成。优化和生成分别计费,使用不同的幂等键。直接生成仍是独立合法路径,不能悄悄替用户多调用一次优化。
查询与恢复
202 返回后按 任务查询 继续。用原 Key 访问原 jobUrl,完成后从 outputs[] 下载。客户端等待结束不取消任务,不要换键重新生成。