Skip to content
SuperToken 文档

MiniMax H3 参数与错误

公共字段

字段必填说明
model固定使用 leonardo-minimax-h3-1440p
operation固定为 generation
input.prompt去除首尾空格后不能为空,最多 1200 个 Unicode 字符
input.reference_mode有参考素材时是frameimagesmedia;纯文本可省略
input.image第一张图片;frame 中是首帧
input.reference_images后续有序图片;frame 中第一项是尾帧
input.reference_audiosmedia;1–3 个 HTTP/HTTPS 音频 URL,不传时长
output.duration5–15 秒整数
output.resolution禁止传模型固定输出 1440p,传入该字段会返回 400 invalid_video_parameter
output.aspect_ratio支持 6 种:1:13:44:316:921:99:16;默认 16:9
output.generate_audioH3 原生成片音轨固定开启;省略或传 true,不能传 false

请求中不要传 input.reference_videosinput.videoprovider_options

分辨率与画幅

H3 只提供一个固定的 1440p 模型规格,不支持通过请求参数切换分辨率。output.aspect_ratio 共支持以下 6 种值:

画幅输出尺寸
1:11440 × 1440
3:41440 × 1920
4:31920 × 1440
16:92560 × 1440
21:93360 × 1440
9:161440 × 2560

参考模式

模式图片数量音频数量语义
省略00纯文本生成
frame1–20第一张是首帧,第二张是尾帧
images1–50全部为普通图片参考,不具有首尾帧语义
media1–51–3普通图片加音频参考,不支持视频

frameimagesmedia 不能在同一任务混用。图片来源保持 input.image 在前、 input.reference_images[] 在后的顺序。音频支持 MP3/WAV,单个最多 15 MB、实际时长至少 2 秒,全部参考音频总时长最多 15 秒;调用方不提供时长字段。

计费

计费由模型价格、output.duration 和用户分组倍率决定。参考图片/音频数量不改变计费秒数; 调用方不需要换算服务端资源消耗。

常见错误

错误码原因处理方式
invalid_video_duration时长不是 5–15 秒调整 output.duration
invalid_video_aspect_ratio画幅不受支持使用表中的六种画幅
unsupported_reference_mode有参考素材但缺少模式,或模式不受支持按素材组合使用 frameimagesmedia
reference_image_limit_exceededframe 超过 2 张或 images 超过 5 张删除多余图片
unsupported_reference_video传入视频参考移除 input.reference_videos
unsupported_reference_audioframeimages 中传入音频改用图片加音频的 media,或移除音频
reference_audio_limit_exceeded音频超过 3 个删除多余音频
invalid_video_parametermedia 缺图片/音频,或显式关闭 H3 成片音轨补全图片和音频,且不要传 output.generate_audio=false
private_generation_unavailable当前服务资源不支持 H3 私有生成联系服务管理员检查该模型的可用资源
idempotency_key_conflict同一 Key 用于不同请求新请求使用新的 Idempotency-Key

参数类 400 不应自动重试。任务进入 submission_unknown 时不要重新创建任务,应先由管理员确认上游是否已接受原请求。

SuperToken - 让全球顶级 AI 模型触手可达