模型MiniMax-H3

MiniMax H3 768P

MiniMax H3 视频模型:时长 4 到 15 秒逐秒可选,支持文生视频、首帧/尾帧控制,也能把参考图片、参考视频与参考音频一起交给模型。这张卡是 768P 档。

视频

自述文件

MiniMax H3(768P)

MiniMax H3 是 MiniMax 的视频生成模型,本平台按 768P 与 2K 两档开放,这张卡是 768P 档。提交一次生成一条视频,不需要自己拼帧。

它的能力

  • 时长逐秒挑:4 到 15 秒,每个整秒都能选,不是 5 / 10 那种固定档。7 秒的转场、13 秒的长镜头都能直接填
  • 三种起手方式:只写文字是文生视频;给首帧是图生视频;首帧和尾帧都给,模型会在两张图之间补完中间的运动
  • 参考素材一起入镜:最多 9 张参考图、3 段参考视频、3 段参考音频。图片锁角色与场景,视频给运动与节奏,音频用来对拍点
  • 七种画幅:自动、21:9、16:9、4:3、1:1、3:4、9:16,竖屏与横屏都不用二次裁切
  • 水印可选:默认不带 AIGC 水印,需要时可以打开

适合拿它做什么

  • 电商与信息流短片:4–15 秒正是商品展示与广告的常见长度
  • 分镜成片:逐段生成,再到画布里接起来,段落之间好改好换
  • 角色延续:用同一批参考图生成多条,保持人物与场景一致
  • 卡拍点的镜头:把音乐或音效当参考音频交进去,让动作跟上节奏

上手建议

  • 先写一个看得见的事件:主体加动作是主干,先把这两块写清楚,再补光线、镜头与声音;一次只加一种控制,出问题才知道是哪句改坏的
  • 让主体动起来:「骑手在雨里向前蹬,车灯扫过积水」比「雨夜氛围」有用
  • 用首尾帧说清起止:想控制镜头从哪到哪,给首帧和尾帧最直接;只给首帧时,结尾由模型自己接
  • 参考图别贪多:一张角色图加一张场景图,通常比九张堆在一起更稳
  • 先出 768P 定节奏:结构对了再换 2K 档出定稿

已知限制

  • 首帧与尾帧各只能 1 张,只给尾帧不给首帧会被拒绝
  • 首尾帧模式不能和参考图混用,两种用法要分开提交
  • 时长写 4–15 之外的整数会直接失败,不会自动裁到边界
  • 参考图前 5 张免费,第 6 张起按张加收;参考视频按输入时长计费,音频免费
  • 参考素材要能被公网访问,本地上传的素材由平台先转成临时地址再提交
  • 提示词上限 8000 字符

定价

档位计价单位单价
默认档秒15 积分/秒

参数

画面比例adaptive / 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16
分辨率768P
可选时长4 / 5 / 6 / 7 / 8 / 9 / 10 / 11 / 12 / 13 / 14 / 15 秒
参考图最多 9 张
参考视频最多 3 段