Grok 视频 Prompt 指南
AI 视频的质量很大程度取决于 prompt。Grok 能理解自然语言,但你写得越具体,模型越容易生成稳定、可用的画面。
一个好 prompt 应该包含什么?#
建议用这个结构:
主体 + 动作 + 场景 + 光线 + 镜头 + 风格 + 画面约束例如:
一名穿黑色风衣的年轻女性走过雨夜街道,
霓虹灯反射在湿润路面上,镜头缓慢向前推进,
电影感,高对比光线,真实质感,人物保持清晰。这个 prompt 比“女人在城市里走路”好得多,因为它同时告诉模型要生成谁、在哪里、怎么动、镜头怎么拍、画面应该是什么质感。
主体要具体#
主体可以是人、产品、动物、建筑或抽象物体,但要写清楚关键特征。比如“一个角色”太宽泛,“穿银色夹克、短黑发、站在未来实验室里的年轻工程师”更可控。
如果是品牌或产品视频,建议上传参考图,并在 prompt 中说明“保持产品形状和标志清晰”。
动作要简单#
一次只写一个主要动作。比如“人物走向镜头并微笑”比“人物跑步、转身、挥手、跳跃并换衣服”更稳定。
AI 视频对复杂互动、手部细节和快速运动仍然容易出错。动作越清楚,结果越自然。
镜头语言很重要#
你可以加入这些词:
slow push-in:缓慢推进
tracking shot:跟拍
wide shot:广角全景
close-up:特写
handheld feel:手持感
bird's-eye view:俯视
镜头词能帮助 Grok 决定画面如何移动,而不只是让主体动起来。
光线和风格决定质感#
常用描述包括:soft morning light、cinematic lighting、warm sunset、studio product lighting、moody contrast、documentary style。中文也可以写,但保留常见英文摄影词有时更稳定。
可复用模板#
[主体] 正在 [动作],位于 [场景]。
光线是 [光线描述],镜头 [镜头运动]。
整体风格 [风格],画面清晰,运动自然,主体保持一致。把这个模板保存下来,每次只替换主体、动作和场景,就能更快找到稳定结果。
常见错误#
不要写过于抽象的情绪,例如“孤独的感觉”。改成可见画面:“一个人坐在空咖啡馆窗边,看着雨水流过玻璃”。模型无法直接拍摄概念,但可以拍摄场景。
