星海智算开发文档
模型 API视频生成

其他视频、长视频与超分

按服务的公开能力分支接入,不混用同一路径下不同模型的参数。

这些能力共享 POST /media/generations,但不共享完全相同的输入。只选择当前模型列表中已开放、且你的 Key 可以调用的服务。

普通文生 / 图生视频

以服务详情的 generationMode、分辨率、画幅和时长为准。图生模式先上传所需图片,再填该模式的素材字段。某些普通 Wan 服务允许 enableRife,不表示 H3 或 Wan Animate 也接受它。

Bernini 模式

服务开放相应能力时,t2v 无素材、r2v 使用参考图片、v2v 使用视频、rv2v 使用图像与视频组合。数量和时长应从模式合同取得,不能仅凭模型名称推测可用状态。没有公开能力或运行不可用时停止,不生成虚假的调用示例。

Helios 长视频

长视频 t2v 使用提示词,不接受图片、视频或音频输入。当前合同为 420p 横/竖屏、固定 24 FPS,时长按服务允许范围及帧量子校验。

{"model":"<HELIOS_MODEL_ALIAS>","generationMode":"t2v","prompt":"固定镜头,海边日落时云层缓慢移动","resolutionTier":"420p","orientation":"landscape","seconds":5,"seed":42}

不要传 batch_sizecolor_correction、任意 FPS 或内部调度参数。它们不是外部调用方可配置的生成规格。

视频超分

上传源视频,再使用该服务公开的输入视频字段和输出规格。超分不是重新生成一段带提示词的视频,不能照抄文生视频请求。输出尺寸、时长与倍率限制由当前服务合同决定。

X-Dub 口型同步

准备人物视频和驱动音频,分别上传为受控输入素材,再引用两个资产 ID。音频最多 60 秒;人物视频允许 15–60 FPS,由服务归一化处理。费用按服务端返回的计费时长与当前单价结算,不自行把上传音频时长当作最终账单。精确格式和容量仍以目标模型当前合同为准。

{"model":"<X_DUB_MODEL_ALIAS>","input_video_asset_id":"<VIDEO_ASSET_ID>","input_audio_asset_id":"<AUDIO_ASSET_ID>","seed":42}

将上面的 JSON 保存为 request.json,按 H3 指南的提交命令 调用同一个公开媒体接口,并使用你自己的稳定幂等键。该请求不需要提示词、秒数或分辨率;不要附加 generationModeresolutionTiersecondsfpsorientation 或速度参数。口型同步与人物动作替换是两种不同能力,不能互用输入规格。

统一恢复方式

所有异步分支保存原任务并 查询终态、下载结果。失败后的恢复以当前错误信息为准,不跨模型复用素材,不因超时就重新生成。

本页目录