IMAGE TO VIDEO

AI 图生视频:让一张首帧开始运动

已有满意的人物、光线和构图时,上传一张你有权使用的成年角色图片,再集中描述动作、镜头与节奏。

仅限成年人使用;仅处理明确成年且来源合法的素材。

范围

首帧能锁住方向,但不是绝对锁定

图生视频把上传图片作为起始画面。提示词应集中描述接下来发生的运动、镜头移动和环境变化,避免反复改写已经确定的外观。

模型仍可能改变脸部、手部、服装或背景。当前图生视频不附加片场声线预设;动作越复杂,越需要缩短镜头并复查。

输入 · 参数 · 输出 · 边界

真实界面、输入与输出

每条都把提示词、参数、成片和失败限制放在一起。能点开的视频才标成真输出;没单独测过的模式会写明。

图生视频:首帧之后只描述运动

黄果制片真实片场的图生视频模式,显示首帧上传区和视频参数
真实 UI 截图,2026-09-04 从本项目本地构建的 /studio?mode=i2v&age=1 捕获。没有上传来源不明的图片,也没有把静态界面称为输出样片。

输入提示词

画面中的明确成年合成角色缓慢抬眼,随后转向窗边;相机小幅向前推,衣料和头发只随动作自然摆动,保持原始服装、光线与房间布局。

可核验参数

模式
图生视频(i2v)
必要输入
1 张有权使用的首帧,单文件不超过 40 MB
单镜时长
6 秒
画幅
与首帧构图匹配;示例为 9:16
声线
当前图生视频请求不附加声线预设

输出结果

本轮未单独测试此模式

本轮已落盘的 5 个 huangguo.design 视频只覆盖角色参考、视频编辑与双镜分镜。当前这组文生视频或普通图生视频配置仍是可复现输入示例,不借用其他模式的结果冒充;页面只对实际完成的三组 Grok 测试下结论。

失败与边界

失败与能力边界

  • 首帧是强参考,不是像素级身份锁定;脸、手、服装和背景仍可能变化。
  • 没有首帧时接口会拒绝请求;图片授权和人物年龄需由上传者确认。
  • 动作越多、镜头越长,保持初始构图和人物细节通常越困难。
用这组配置进入片场

WHAT IT DOES

当前可以控制的部分

FIRST FRAME

从已确认画面出发

首帧适合固定人物站位、服装、环境和构图;必须由你制作或已获使用权。

MOTION

只写接下来的变化

描述动作、推拉摇移和环境动态,一次只安排一个主要动作。

LIMITS

把一致性当作检查结果

不能保证像素级保持原图,也不能替你证明素材授权或年龄。

WORKFLOW

四步完成一次生成

01

准备合法首帧

人物明确成年,避免低清、遮挡或来源不明照片,单文件不超过 40 MB。

02

选择图生视频

上传首帧,确认预览,再设置画幅、时长和清晰度。

03

描述运动

写人物如何动、镜头如何动,以及必须保持不变的关键元素。

04

先预览短镜头

优先用 4–8 秒验证动作和脸部稳定性,再决定下一镜。

FAQ

常见问题

上传后会完全保持原脸吗?

不会保证。首帧是强参考,但模型仍可能改变五官、手部、服装和背景。

提示词应该怎样写?

集中写动作、镜头、速度和环境变化,不必重复首帧已有外观。

可以上传多大的图片?

当前接口限制单文件不超过 40 MB,上游还可能按文件内容拒绝。

素材会发送给谁?

为生成视频,图片和提示词会发送给 xAI;不要上传无权使用的隐私素材。

START SMALL

用一张明确首帧做短测试

先验证 4–8 秒的单一动作,再决定是否扩成多镜头。