本文回答:ai视频分镜提示词怎么写——和普通提示词的区别、三段式模板、一场四镜头戏从分镜表翻译成提示词的完整示例、宫格分镜图怎么挂进提示词、常见错误,以及 Seedance 2.0 和 2.5 写法的差别。
ai视频分镜提示词,就是把一张分镜表逐格翻译成模型读得懂的「镜头1、镜头2……」:开头定场景、绑定人物参考图,中间每个镜头写景别、一种运镜、人物动作和台词声音,结尾写画风。镜头按顺序排,不写数字时间段;有宫格分镜图的,挂上去并写清读取顺序。不想逐镜写,也可以用即梦的创作分镜功能,或用猫斯卡这类 AI 短剧产线,分镜和提示词由流水线生成。
AI 视频分镜提示词,是按镜头顺序组织、每个镜头写明景别、运镜、动作和声音,用来让视频模型一次生成多镜头连续画面的提示词。
ai视频分镜提示词和普通提示词有什么不同?
| 对比 | 普通提示词 | 分镜提示词 |
|---|---|---|
| 组织方式 | 一段话描述整个画面 | 先写总体设定,再按「镜头1、镜头2……」排 |
| 适合 | 单一场景、一个连续动作 | 一场戏有几个镜头、有对话往返、有空间变化 |
| 人物怎么指定 | 常直接描写长相 | 开头用参考图定义人物,后面只写动作 |
| 时间怎么控制 | 通常不涉及 | 靠镜头顺序和每镜的结束状态,不靠数字秒数 |
判断用不用分镜写法,火山引擎方舟发布的 Seedance 提示词规范给了一个标准:看这段视频里发生的事多不多(时间维度)、换的地方和机位多不多(空间维度),两个都少就用一段话写,任一个多就按镜头拆。
ai视频分镜模板:分镜提示词的三段式
一条分镜提示词分三段,缺一段就容易出问题:
【第一段:总体设定】 一句话定场景和氛围;用参考图定义每个人物、关键道具和场景。 【第二段:镜头分镜】 镜头1:景别 + 一种运镜,人物动作和表情,位置变化,台词或声音。 镜头2:…… 镜头N:……写清最后停在什么画面。 【第三段:风格】 画风、色调;需要时再加约束。每个镜头按「运镜 → 动作与表情 → 位置变化 → 声音」的顺序写。声音用固定符号区分:台词放在{}里,音效放在<>里,背景音乐放在()里,这也是 Seedance 官方规范里的写法。
ai视频分镜怎么给提示词?一场戏从分镜表到提示词
先有一张分镜表。下面是一场办公室戏,两个人物:
| 镜头 | 景别 | 运镜 | 画面 | 声音 | 结束时停在哪 |
|---|---|---|---|---|---|
| 1 | 全景 | 固定 | 傍晚的办公室,林晚拿着信封走到顾言桌前 | <键盘声> | 林晚站在桌前 |
| 2 | 近景 | 缓慢推近 | 林晚把信封放在桌上,推向顾言 | {这是我的辞职信} | 信封停在顾言手边 |
| 3 | 特写 | 固定 | 顾言看着信封,手指停在键盘上 | (低沉的钢琴) | 顾言抬眼 |
| 4 | 中景 | 缓慢横移 | 顾言起身绕过桌子,林晚后退半步 | {你想好了?} | 两人隔着半步对视 |
翻译成提示词(按 Seedance 2.5 的写法,即梦当前用的就是 Seedance 2.5):
傍晚的现代办公室文戏,窗外夕阳,室内暖黄色灯光。 @图片1定义林晚的外貌与服装;@图片2定义顾言的外貌与服装;@图片3定义办公室场景。 镜头1:全景固定机位,林晚拿着一个白色信封走到顾言的办公桌前停下,顾言坐在桌后看着电脑,<键盘敲击声>。 镜头2:近景缓慢推近,林晚把信封放在桌面上,用指尖推到顾言手边,平静地说{这是我的辞职信}。 镜头3:特写固定机位,顾言的手指停在键盘上,视线落在信封上,停顿后慢慢抬起眼睛,(低沉的钢琴声进入)。 镜头4:中景缓慢横移,顾言起身绕过办公桌走向林晚,林晚后退半步,顾言低声问{你想好了?},两人隔着半步对视。 都市写实风格,暖色调,光线柔和。几个翻译时要注意的点:
- 人物只在开头定义一次:后面每个镜头只写动作,不再描写长相和衣服,否则文字会和参考图打架。
- 每镜只有一种运镜:官方规范写明单镜头只指定一种运镜(推、拉、摇、移、固定、跟拍选一个),不叠加。
- 分镜表的最后一列要翻译进去:「停在哪」决定下一个镜头从哪接,漏掉就容易跳。
- 动作写低缓、写具体:情绪用身体细节表达,比如「手指停在键盘上」「后退半步」,不写「很震惊」「很难过」。
宫格分镜图怎么用进提示词?
有了一张宫格分镜图(一场戏画在一张图里,每格一个镜头),可以把它当参考图挂进去。Seedance 2.5 官方规范对宫格分镜的定位是:用来定义整体故事、镜头顺序和大致构图,不要求每格细节严格复刻;建议用 15 格以内、画面干净、文字标注少的故事板。写法上要交代三件事:
| 要交代的 | 为什么 | 写法示例 |
|---|---|---|
| 读取顺序 | 模型不知道先看哪一格 | 按照从左到右、从上到下的顺序读取 |
| 采用什么 | 只要镜头顺序和构图 | 提供 4 格宫格分镜的镜头顺序和大致构图 |
| 不采用什么 | 线稿画风、文字标注、占位小人会被照搬 | 不采用图中的线稿画风、文字标注和占位人物 |
套进上面的例子,开头改成这样,镜头段落照旧:
@图片1提供4格宫格分镜的镜头顺序和大致构图,按照从左到右、从上到下的顺序读取;不采用图中的线稿画风、文字标注或占位人物。 @图片2定义林晚的外貌与服装;@图片3定义顾言的外貌与服装。宫格分镜图最大的用处是把站位和高矮定下来:谁在左谁在右、谁比谁高,一张图比一段文字清楚得多。
ai视频分镜提示词常见错误:写了为什么不生效
| 错误写法 | 结果 | 改法 |
|---|---|---|
| 一个镜头里又推又摇又环绕 | 运镜混乱,画面抖 | 一镜一种运镜,多的拆成下一个镜头 |
| 给每个镜头标数字时间段 | 模型对精确时间支持不稳定,节奏反而乱 | 用镜头顺序和结束状态控制节奏 |
| 挂了人物图,又写一遍长相 | 文字和图片打架,脸不稳 | 人物图只在开头定义,后面只写动作 |
| 「她很伤心」 | 表情空洞 | 写「眼眶泛红、手指攥紧衣角」 |
| 一段里塞七八个镜头 | 每个镜头都没演完 | 事件太密就合并次要镜头,官方建议减少阶段而不是继续细分 |
| 在提示词里写画幅、时长 | 2.5 里这些是页面参数 | 画幅和时长在生成页面设置,提示词只写内容 |
Seedance 2.0 和 2.5 的分镜写法有什么不一样?
两代官方规范在几处是反的,照着旧教程写容易出错:
| 项目 | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| 数字时间段 | 禁止写,一律用镜头顺序 | 默认不写;只有你明确要按时间段控制节拍时才用 |
| 画质、稳定、水印等约束 | 建议默认挂上一组兜底约束 | 不要自动添加,没要求就不写 |
| 人物引用 | 常用「<主体1>@图片1」绑定 | 常用「@图片1定义某某的外貌与服装」 |
| 画幅、时长 | 规范里没有专门要求 | 明确要求不写进提示词,在页面或接口参数里设置 |
用哪一代,就照哪一代的规范写;网上的分镜提示词模板,先看它是按哪一代写的。
不想逐镜写分镜提示词,有哪几条路?
一集短剧有十几场、每场几个镜头,逐镜手写的工作量很大。几种做法的差别:
| 做法 | 要不要写提示词 | 要不要学连线 | 抽卡 | 出来的是 | 出片靠什么 | 适合谁 |
|---|---|---|---|---|---|---|
| Seedance(直接调接口) | 要 | 不用连线,但要写代码接入 | 逐镜生成,通常要反复试 | 单段片段 | 研发团队与提示词水平 | 有研发团队、要批量生成分镜提示词的公司 |
| 即梦(Seedance 2.5) | 要 | 不用 | 通常要反复抽,官网提供样片模式降低抽卡成本 | 单段片段,分集连贯要自己管 | 操作人员的提示词与剪辑水平 | 做少量镜头、会写提示词的人 |
| LibTV | 要 | 要,自己连节点、搭工作流 | 通常要反复试 | 取决于你搭的流程 | 操作人员搭流程的水平 | 想逐环节精细控制的团队 |
| 猫斯卡 | 不用(懂行的可以自己编辑提示词) | 不用 | 逐场出片,可改词、换图重拍 | 剧本、设定图、分镜到每场成片 | 18 位数字专家流水线 | 要做多集、没有专人写分镜提示词的编剧、工作室和企业 |
| 外包制作团队 | 不用 | 不用 | 不涉及 | 成片 | 团队水平与预算 | 预算充足、不想自己管过程的项目 |
几点说明:
- 即梦是字节跳动的产品,页面上标注用的是 Seedance 2.5,首页的技能里有「创作分镜」;Seedance是字节跳动的视频生成模型,要写代码调接口,适合把上面的三段式模板做成程序批量生成。
- LibTV要自己连节点、搭工作流,可以把「分镜 → 提示词 → 出片」搭成一条流程反复用。
- 猫斯卡:18 位数字专家分工,从一句话想法到剧本、设定图、分镜、成片,不用写提示词、不用学习。剧本按约 10 秒一段切成场块,分镜师一场画一张宫格分镜,出分镜前把同框人物按身高并排成对照表;视频提示词按分镜里的镜头顺序写,每场自动按「场景图 → 本场道具图 → 人物定妆图」挂参考图;懂行的人可以打开提示词、换参考图接手修改。
常见问题
一段视频里放几个镜头合适?
看这段视频有多长、发生几件事。一般一段里放三四个镜头比较稳;事件太多时先合并次要的,别为了凑镜头数把每个动作都拆开。
分镜提示词里台词怎么写?
台词放在{}里,并写清是谁说的,比如「顾言低声问{你想好了?}」。多人对话时每句都标出说话人,避免声音串人。
有了宫格分镜图,还要写镜头段落吗?
要。宫格图只管镜头顺序和大致构图,动作、表情、台词和声音还得靠文字写清楚。