grok-imagine-video/v1.5
平台接入的 Grok 视频线路:单条 6 到 15 秒逐秒可选,480p / 720p 两档分辨率,16:9、9:16、1:1 三种画幅。支持文生视频、图生视频与多图参考,最多 7 张参考图锁住角色与场景。按条计价:一条一个价,与时长无关。
自述文件
grok-imagine-video/v1.5
本页是这条视频线路的能力说明。提交一次生成一条视频,按条计价。
它的能力
- 时长 6 到 15 秒逐秒可选:每个整秒都能填,7 秒的转场、12 秒的对白段都不用凑固定档
- 三种画幅:16:9、9:16、1:1,横屏展示与竖屏短剧各有对应机位,不需要出片后再裁
- 480p / 720p 两档分辨率:480p 定结构、试镜头,720p 出成片
- 三种起手方式:只写文字是文生视频;给一张图是图生视频;多给几张图就按参考生成,最多 7 张,用来锁角色、场景与商品外观
- 输出无声:模型只出画面,配音、配乐与字幕在音频轨里单独加
适合拿它做什么
- 竖屏对白短剧:把台词按镜头切开,一个镜头一条,语速与停顿都能对上
- 电商短视频:6–15 秒正是商品展示、功能演示与信息流的常见长度
- 角色延续:同一批参考图连着出几条,人物脸型、发型与服装保持一致
- 分镜试拍:先用 480p 把节奏与构图跑通,结构定了再换 720p 出定稿
上手建议
- 按时间轴写分镜:把「第几秒到第几秒、谁在做什么、说什么」一段段列清楚,模型对逐段描述比一段长散文更听话
- 台词写进提示词:需要口型的镜头,把台词原文放在引号里并标出说话人,比只写「两人对话」稳
- 锁住不该变的东西:明确写出「五官、发型、服装全程不变」「镜头稳定无抖动」,比事后补画面省事
- 参考图别贪多:一张角色图加一张场景图,通常比七张堆在一起更稳
- 先定画幅再写内容:竖屏镜头和横屏镜头的构图讲法完全不同,先定画幅能少改一版
计价
- 按条计费:提交一条扣一条,480p 与 720p 各一个价,与时长无关
已知限制
- 时长只支持 6–15 秒的整数,超出范围会直接失败,不会自动裁到边界
- 画幅只有 16:9、9:16、1:1 三种,没有 21:9 与 4:3
- 只支持参考图(最多 7 张),不支持参考视频与参考音频
- 输出为无声视频
- 提示词上限 8000 字符
定价
| 档位 | 计价单位 | 单价 |
|---|---|---|
| 480P | 次 | 150 积分/次 |
| 720P | 次 | 180 积分/次 |
参数
| 画面比例 | 16:9 / 9:16 / 1:1 |
| 分辨率 | 480p / 720p |
| 时长范围 | 6–15 秒,1 秒步进 |
| 参考图 | 最多 7 张 |