星海智算开发文档
模型 API视频生成

MiniMax H3 四种视频模式

文生视频、图生视频、首尾帧和全能参考采用不同的素材合同。

先选择模式

H3 通过 POST /media/generations 创建视频任务。公开模型别名以 Portal 详情为准;不要使用服务实例 ID。

模式generationMode输入
文生视频t2v提示词,不传素材
图生视频i2vinput_image_asset_id
首尾帧first_last_frame_videoinput_image_asset_idend_image_asset_id
全能参考universal_reference_video有序 referenceInputs,至少一张图片或一个视频

当前 H3 合同以 768p、横/竖屏、5–15 秒整数时长、24 FPS 音画同步 MP4 为基础。合法组合与输入上限仍应读取当前模型详情;不要传任意像素、内部帧数、采样步数或插帧参数。

创建请求

先按 快速开始 设置三个环境变量。将下列 JSON 保存为 request.json,替换 model。相同业务请求使用稳定的幂等键。

{
  "model":"<MODEL_ALIAS>",
  "generationMode":"t2v",
  "prompt":"雨后街道,镜头缓慢前移,人物撑伞走过,保留自然雨声",
  "resolutionTier":"768p",
  "orientation":"landscape",
  "seconds":5
}
curl --fail-with-body --max-time 60 "$JUSP_BASE_URL/media/generations" \
  -H "Authorization: Bearer $JUSP_API_KEY" \
  -H 'Content-Type: application/json' \
  -H 'Idempotency-Key: your-stable-business-request-id' \
  --data-binary @request.json --output create.json

图生视频在上例中改 generationMode 并增加首图资产 ID。首尾帧再增加 end_image_asset_id;两张图均需提前上传,不把本地路径放进 JSON。

全能参考

以下结构替换 t2v 的模式,并加入 referenceInputs

{
  "generationMode":"universal_reference_video",
  "referenceInputs":[
    {"role":"reference_image","mediaType":"image","assetId":"<IMAGE_ASSET_ID>"},
    {"role":"reference_video","mediaType":"video","assetId":"<VIDEO_ASSET_ID>"},
    {"role":"reference_audio","mediaType":"audio","assetId":"<AUDIO_ASSET_ID>"}
  ]
}

该代码块是要合入完整请求的片段,不是独立请求。参考顺序有意义:图片、视频、音频分别有序,不重复同一个素材。提示词可明确每项素材的用途。

限制当前合同
图片0–9 张;存在视频时最多 8 张
视频0–1 个
音频0–3 段,每段 2–15 秒,总时长不超过 15 秒
总数不超过 12;至少一个视觉素材
提示词不超过 7000 个字符

全能参考图片单张不超过 30 MiB,视频不超过 50 MiB,音频不超过 15 MiB;首尾帧图片使用另一套限制。像素、格式、时长等完整约束以服务详情为准。MOV 音频参考必须按 audio 上传身份处理。

是否使用智能优化

当前服务推荐优化时,可以先调用 提示词优化,展示结果供用户编辑,再决定是否生成。优化和生成分别计费,使用不同的幂等键。直接生成仍是独立合法路径,不能悄悄替用户多调用一次优化。

查询与恢复

202 返回后按 任务查询 继续。用原 Key 访问原 jobUrl,完成后从 outputs[] 下载。客户端等待结束不取消任务,不要换键重新生成。

本页目录