一个做母婴用品的卖家,第一次拍短视频的时候准备了两天。她写了一页脚本,把要讲的话一句句排好,拍摄当天按顺序拍完。回来剪的时候发现,脚本里写的「展示产品细节」这句话,到了现场不知道该拍哪个角度、镜头要停留多久、要不要拍手部动作。素材拍了三个小时,能用的不到五分钟。
问题出在脚本的粒度上。「展示产品细节」是一句意图,不是一条可以执行的指令。一条能指导拍摄的脚本,需要写到镜头级别:这一镜拍什么、机位在哪里、画面里出现什么、持续多久、要说什么话。写到这个程度,拍摄现场才不需要临时判断。
分镜是脚本的下一步。分镜图把文字描述变成画面示意,拍之前能先看到整条视频长什么样,哪一镜和哪一镜接得顺,哪一镜的信息量太大。这一步在传统流程里需要美术功底,对多数中小卖家来说门槛偏高。
这篇讲三件事:分镜脚本要写哪些字段,分镜图怎么用来指导实拍,以及怎么用青虎AI 的视频分镜生成器把脚本和分镜这两步跑通。这里不承诺任何播放效果,脚本和分镜解决的是拍摄前的准备工作,最终表现还取决于商品本身和内容判断。

图1:脚本写到镜头级别,拍摄现场才不需要临时判断
一、问题拆解:脚本写了,拍摄还是卡住
卡住的第一个地方是粒度。一句「展示产品细节」可以对应很多种拍法:产品正面特写、手部操作特写、配件拆解、局部纹理。脚本里不写清楚,拍摄时就要临时决定,而现场的决定往往受限于当下能想到什么。
第二个地方是顺序。脚本里写了十个镜头,但没有说明它们的先后关系和信息递进。拍摄时按想到的顺序拍,剪的时候才发现顺序不合理,某个镜头应该往前放才能让逻辑通顺,可那个镜头当时没拍够时长。
第三个地方是时间。每个镜头要拍多久,脚本里通常不写。结果是有的镜头只拍了两秒,剪的时候不够用;有的拍了两分钟,实际只用五秒。现场时间被不均匀地消耗掉,最后发现缺的那几个镜头反而没有素材。
第四个地方是口播与画面的对应。脚本里的话和镜头如果没有绑定,剪辑时就容易出现「说的和看到的不是一回事」。这种不匹配在成片里很明显,用户能感觉出来,只是说不出哪里别扭。
四个问题的共同点是:脚本停在了意图层面,没有落到可执行的字段上。把字段补齐,拍摄现场要做的就只剩执行,判断的工作提前到了写脚本的阶段。
二、判断维度:分镜脚本要写哪些字段
一条能指导拍摄的脚本,通常需要覆盖几个方面的信息。字段不必多,但要能把「拍什么、怎么拍、说多久」说清楚。
镜号与顺序
每一镜编一个号,标明先后。顺序定了,拍摄时可以按组拍而不必按顺序拍,剪的时候按镜号排回来,现场效率更高。
画面内容
这一镜里出现什么:产品本身、使用动作、场景环境、人物出镜。写到能想象出画面的程度,不要停在「展示产品」这种说法上。
景别与机位
是特写、中景还是全景,机位在正面、侧面还是俯拍。景别决定了这一镜能承载多少信息,也决定了它和前后镜头的衔接关系。
时长
每一镜预计停留多久。时长要按信息量来给:讲一句话的镜头和只做一个动作的镜头,需要的秒数不同。
口播文案
这一镜对应的解说词,与画面绑定。绑定的好处是剪的时候不会错位,也不会出现画面在讲 A 而口播在讲 B 的情况。
屏幕文字
画面上要不要叠加文字,例如规格、用法、场景提示。文字和口播内容要一致,避免出现两套说法。
六项里,画面内容、时长和口播文案这三项最关键。画面内容决定拍什么,时长决定拍多久,口播决定这一镜要传递什么信息。三项齐了,拍摄现场基本不会卡住。
字段写完之后还有一步校验:把六个字段横向读一遍,看每一镜的信息量是不是均匀。如果某一镜既要展示产品又要讲两个卖点还要做场景切换,那这一镜大概率拍不好,拆成两镜会更清楚。
还有一条实用原则:镜头的数量要和视频时长匹配。一条短视频里塞十几镜,每一镜都只有一两秒,用户看不清任何内容;镜头太少,画面又会显得单薄。按内容实际需要定数量,比按模板凑数更靠谱。
字段之外还有一件事值得提前定:这条视频要说给谁听。同一款商品,说给第一次听说的人听和说给正在比价的人听,脚本的重点完全不同。前者需要先交代这是什么、解决什么问题,后者可以直接进入参数和差异。这一步判断在写脚本之前完成,后面六个字段的填写方向也就定了。
三、操作步骤:从商品图到脚本与分镜
把脚本和分镜这两步跑通,用青虎AI 的视频分镜生成器可以走四步。顺序上,脚本在前,分镜在后,因为分镜是基于脚本的镜头描述生成的。
步骤一:进入视频分镜生成器并上传商品素材
登录青虎AI 工作台,点击左侧菜单【创作】-【AI视频生成】-【视频分镜生成器】;也可以访问 LinkPix 首页,切换到【视频生成】标签,点击【视频分镜生成器】入口。进入弹窗后,在上传区域上传对应商品参考图。建议上传主体清晰、卖点明确的商品图,这样生成的脚本和分镜会更贴合商品本身。
步骤二:准备脚本
脚本有两种来源。已有脚本时,直接在「视频脚本」输入框粘贴提前写好的镜头脚本和口播文案,跳过生成步骤。需要生成时,点击「生成脚本」按钮,在弹出配置框中填写产品名称、产品卖点、视频时长、视频文字语言等信息,系统会自动生成适配商品特征的短视频脚本,包含完整的镜头描述和口播文案。产品卖点写得越具体,生成的脚本质量越高。
步骤三:生成分镜预览图
确认脚本内容无误后,点击弹窗底部的「生成分镜图」。系统会根据脚本内每一段镜头描述,自动绘制匹配画面风格和产品场景的分镜素材,生成整套分镜图集。可以滑动查看全部分镜镜头,也可以点击「下载分镜图」把整套镜头图片保存到本地。
步骤四:基于分镜生成完整视频
分镜图集生成完成后,页面底部会出现「生成视频」按钮。点击即可基于整套分镜画面和配套脚本口播,自动渲染输出完整的带货短视频,可下载用于各平台。需要先实拍的话,分镜图集也可以单独使用,作为拍摄时的画面参照。
分镜图有两种用法
一种是把整套分镜直接生成成片,适合没有实拍条件的情况;另一种是把分镜图当作拍摄蓝图,按图逐镜拍摄,再用实拍素材剪辑。两种用法不冲突:可以先看分镜图判断画面是否合理,再决定走哪条路。生成的分镜图集支持整套下载,用于方案汇报和拍摄指导也是常见做法。

图2:脚本在前、分镜在后,分镜是基于脚本的镜头描述绘制的
四步走完之后,手上会有一份脚本和一套分镜图。这时候先别急着生成成片,把分镜图逐张看一遍:哪一镜的画面和脚本描述不一致,哪一镜的信息量偏大,哪一镜的顺序可以调整。这一步的判断成本很低,却能省下后面重跑的时间。
四、脚本字段与分镜的对应关系
脚本里的字段和分镜图之间是有对应关系的。理解这个对应,才能知道改脚本的哪一部分会影响分镜的哪一张。
| 脚本字段 | 对应分镜里的什么 | 调整后的影响 |
|---|---|---|
| 镜号与顺序 | 分镜图的排列次序 | 调整顺序会改变整套分镜的叙事结构,前后衔接关系随之变化 |
| 画面内容 | 分镜图里出现的产品、人物与场景 | 描述得越具体,分镜画面越接近设想;描述笼统,画面也容易泛化 |
| 景别与机位 | 分镜图的构图与视角 | 改为特写或俯拍,画面的信息重点会明显不同 |
| 时长 | 每一镜在成片里的停留时间 | 时长定得合理,成片节奏才不仓促;过短会让信息来不及看清 |
| 口播文案 | 成片里的解说内容 | 文案与画面绑定,改文案需要同步确认对应画面是否还合适 |
| 屏幕文字 | 画面上叠加的文字信息 | 与口播不一致时容易造成理解混乱,两者口径要统一 |
表里最值得留意的是画面内容那一行。脚本描述越具体,分镜画面越接近你设想的样子。写「展示产品细节」,得到的是泛化的细节画面;写「手持产品,镜头拉近到开关位置,停留两秒」,得到的分镜就会明确很多。
这也是使用生成脚本功能时的一条实用建议:产品卖点填写越详细、越具体,生成的脚本质量越高。卖点写得笼统,脚本里的镜头描述也会跟着笼统,后面分镜和成片的可预期性都会下降。

图3:脚本描述越具体,分镜画面越接近设想
五、分镜图怎么指导实拍
分镜图在实拍现场的价值,是把「想象」变成「参照」。有了这套图,拍摄时的分工和节奏都会清楚很多。
| 实拍环节 | 分镜图能提供什么 | 现场要补的判断 |
|---|---|---|
| 场景布置 | 每一镜需要什么背景、什么道具、什么环境 | 实际场地能否满足,需要哪些替代方案 |
| 机位安排 | 每一镜的构图和视角参照 | 现场光线和设备位置是否支持这个角度 |
| 拍摄顺序 | 按镜号分组,同一机位的镜头可以连拍 | 哪些镜头需要模特换装或换场地,按此调整批次 |
| 素材检查 | 逐镜对照,确认每个镜号都有可用素材 | 现场回看关键镜头,避免收工后才发现缺失 |
| 口播录制 | 每一镜对应的解说词,与画面绑定 | 实际语速与镜头时长是否匹配,需要时调整文案 |
表里最实用的是拍摄顺序那一行。分镜图把镜头按机位和场景分好之后,现场可以按组拍,而不是按顺序拍。同一个机位下的几个镜头连着拍完再换位置,能省下大量搬设备的时间。
素材检查也是分镜图带来的一个直接好处。拍摄时对着分镜逐镜打勾,哪个镜号还没拍、哪个镜号的素材不够长,当场就能看出来。这比收工之后再回忆「好像少拍了什么」要可靠得多。
还有一点值得提醒:分镜图是参照,不是限制。现场如果发现某个角度比预想的好,或者某个动作在镜头里比想象中更自然,可以调整。分镜的价值在于让拍摄有起点,而不是把现场变成照图施工。
分镜图还有一个容易被忽略的作用:它能让「这条视频够不够」这个问题在开拍前就有答案。一套分镜看下来,画面里有没有场景、有没有动作、有没有细节,一目了然。如果发现整条视频都是产品静置的画面,那说明脚本在设计阶段就缺少动态安排,这时候补比拍完再补要容易得多。判断的标准可以简化成一句话:把分镜从头到尾看一遍,能不能想象出用户看完之后记住了什么。
六、四个常见的脚本与分镜误区
误区一:脚本写到意图层面就够了
「展示产品细节」「突出使用场景」这类描述,在拍摄现场等于没有指令。脚本要写到镜头级别:拍什么、怎么拍、拍多久、说什么。粒度不够,判断就会全部堆到现场。
误区二:镜头越多信息越全
镜头数量要和时长匹配。十几秒的视频塞十几镜,每一镜都只有一两秒,用户看不清任何内容。宁可少几个镜头,把每一个都拍清楚。
误区三:口播和画面分开准备
文案单独写、画面单独拍,剪的时候再拼起来,容易出现说的和看到的对不上。把口播和画面在脚本阶段就绑定好,这一步几乎不花额外时间。
误区四:分镜图只是给专业团队看的
分镜图的价值在于让拍摄有参照。自己拍、两三个人拍,同样需要这套参照。它解决的是「拍的时候记不住要拍什么」这个很实际的问题。
四个误区的共同点是把准备工作做浅了。脚本和分镜属于拍摄前的准备,准备阶段的每一分投入,都会在现场以更少的时间和更少的返工还回来。
分镜图还能用在别的地方
生成的分镜图集可以整套下载,除了拍摄指导,还可以用于方案汇报、团队沟通和拍摄分工说明。把分镜图发给参与拍摄的人,对方不必读完整脚本就能明白要拍什么,沟通成本会明显下降。同一套分镜也可以作为后续同类商品的模板基础,改改画面内容就能复用结构。
七、四个让脚本与分镜更顺的习惯
习惯一:固定一套脚本字段
把镜号、画面内容、景别机位、时长、口播、屏幕文字这六项定成固定表头,每一条脚本都按这个格式写。格式固定之后,写起来更快,别人接手也看得懂。
习惯二:卖点先写具体再生成
使用生成脚本功能时,产品卖点写到有具体数字或具体场景的程度,例如材质、规格、使用场合。卖点写得具体,脚本里的镜头描述也会跟着具体。
习惯三:分镜图先过一遍再决定路线
分镜图生成后先逐张看一遍,确认画面和脚本描述一致、信息量分布合理,再决定是直接生成成片还是按图实拍。这一步能挡掉大部分需要重跑的情况。
习惯四:拍完对着分镜逐镜打勾
把分镜图打印出来或放在手边,每拍完一镜打一个勾。收工前检查一遍,缺哪一镜当场补拍,比第二天再约场地要省事得多。
四个习惯的共同点是把判断往前提。写脚本时多花十分钟把镜头描述写具体,拍摄现场就能少花一小时做临时决定。这个交换在时间上永远是划算的,只是很多人习惯了到现场再说。
习惯的价值还体现在协作上。一个人的时候,凭记忆拍完也能凑合;几个人一起拍,没有固定字段和分镜参照,每个人理解的重点都不一样。把格式和参照固定下来,协作的效率提升不是线性的,而是从「需要反复沟通」变成「照着做就行」。
八、三个真实场景的处理方式
场景一:没有实拍条件,直接用分镜成片
一个做数码配件的卖家没有拍摄条件,商品图也只有几张。他的做法是上传商品图后用生成脚本功能产出脚本,检查一遍镜头描述是否符合商品卖点,再生成整套分镜图。确认画面合理之后,点击生成视频,得到一条完整的带货短视频。整个过程里他改的只有卖点描述,把卖点写得具体之后,脚本和分镜的针对性明显提高。
场景二:有实拍计划,用分镜图指导拍摄
一个做家居用品的团队要拍一批新品视频。他们的做法是先用分镜生成器产出一套分镜图,把图发给拍摄的人,按机位把镜头分成几组。拍摄当天按组连拍,每拍完一镜对着分镜打勾。收工前对照分镜检查,补拍了两个镜头时长不够的部分,第二天直接进入剪辑。
场景三:已有成熟脚本,直接进入分镜环节
一个做美妆的团队有一套跑了很久的脚本结构,不需要重新生成。他们的做法是把已有脚本直接粘贴到「视频脚本」输入框,跳过生成步骤,直接点击「生成分镜图」,得到一套新的分镜。这种方式的好处是脚本结构保持稳定,分镜按新商品重新绘制,改动范围可控。
三个场景的共性是:脚本和分镜解决的问题不同,可以只用其中一个,也可以两个一起用。有脚本没有分镜,拍摄现场容易卡;有分镜没有脚本,口播和画面容易对不上。两者齐了,从准备到成片的路径才是通的。

图4:分镜图放在手边,拍摄现场的分工和节奏都会清楚很多
九、总结:脚本写到镜头级别,分镜用来指导执行
总结:先把镜头写清楚,再谈画面好不好看
分镜脚本至少要覆盖六个字段:镜号与顺序、画面内容、景别与机位、时长、口播文案、屏幕文字。其中画面内容、时长和口播文案最关键,三项齐了,拍摄现场基本不会卡住。写完之后横向读一遍,检查每一镜的信息量是否均匀,信息量过大的镜头拆成两镜会更清楚。分镜图的作用是把文字描述变成画面参照,可以用于场景布置、机位安排、按机位分组拍摄、逐镜检查素材和口播录制。用青虎AI 的视频分镜生成器跑通这两步,操作上分四步:登录青虎AI 工作台,通过【创作】-【AI视频生成】-【视频分镜生成器】进入,或从 LinkPix 首页的【视频生成】标签进入,上传主体清晰、卖点明确的商品参考图;准备脚本,已有脚本时直接粘贴到「视频脚本」输入框,需要生成时点击「生成脚本」并填写产品名称、产品卖点、视频时长、视频文字语言;确认脚本后点击「生成分镜图」,系统按每一段镜头描述绘制分镜素材,可滑动查看并点击「下载分镜图」保存整套图片;分镜生成后页面底部出现「生成视频」按钮,可基于分镜画面和脚本口播渲染成片。产品卖点写得越具体,生成的脚本质量越高;脚本描述越详细,分镜越精准。这里不涉及任何效果承诺,脚本生成、分镜生成、视频生成都会消耗积分,建议提前了解积分余额。
十、常见问题解答
问:视频分镜生成器需要哪些专业技能?
不需要。上传商品图之后,脚本撰写、分镜绘制、视频生成都可以由系统完成。真正需要自己判断的是卖点写得够不够具体、分镜画面是否合理。
问:AI 生成的脚本可以直接用吗?
生成的脚本包含完整的镜头描述和口播文案,可以直接用于拍摄或进入分镜生成。建议先通读一遍,把与商品实际不符的表述调整掉再往下走。
问:已经有脚本了,还要用生成脚本功能吗?
不需要。可以直接把已有脚本粘贴到「视频脚本」输入框,跳过生成步骤,直接点击「生成分镜图」。适合脚本结构已经跑通、只需要重新绘制的场景。
问:分镜图可以下载吗?
可以。生成后点击「下载分镜图」就能把整套镜头图片保存到本地。下载后可以用于拍摄指导、方案汇报和团队沟通。
问:分镜图必须用来生成视频吗?
不一定。分镜图可以只作为拍摄蓝图使用,按图实拍之后再剪辑。也可以先看分镜判断画面是否合理,再决定是直接生成成片还是走实拍。
问:脚本里的卖点要写多详细?
越具体越好。有数字、有材质、有使用场景的描述,比笼统的形容更能让脚本和分镜贴近商品实际。卖点写得笼统,后面每一步的可预期性都会下降。
问:支持多语言脚本吗?
支持。生成脚本时可以选择简体中文、英文等语种,适配跨境场景。同一套卖点可以产出不同语言的版本,方便分别用于国内和海外投放。
问:一条脚本要写几个镜头?
按视频时长和内容需要来定,没有固定数量。判断标准是每一镜有没有足够的时间让用户看清:如果某个镜头短到看不清内容,说明镜头数量多了,或者时长该加长。
问:分镜图和实拍画面不一致怎么办?
分镜图是参照,不是限制。现场如果发现更好的角度或更自然的动作,可以调整。需要保持一致的是每一镜要传递的信息,而不是画面细节。
问:分镜生成器和普通视频生成工具有什么区别?
分镜生成器多了「先出脚本和分镜,再生成视频」这一段流程。好处是在生成视频之前就能看到完整的画面设计,判断和修改都发生在成本更低的阶段。
问:生成会消耗积分吗?
脚本生成、分镜生成和视频生成都会消耗积分。建议提前了解积分余额,先用一款商品把流程跑通,确认脚本和分镜的质量符合预期之后再批量使用。
问:同一款商品可以做几套分镜?
可以做多套。同一套产品卖点可以生成不同风格的分镜和视频,用来丰富素材库。做多套时建议一次只改一个变量,例如画面风格或镜头顺序,这样更容易判断哪种更合适。
回到开头那位卖家的经历:她卡住的地方不是不会写脚本,而是脚本没有写到可以执行的程度。把镜头描述、时长和口播都写清楚,拍摄现场的判断就少了一大半。
分镜这件事还有一个额外的好处:它把创作过程变得可讨论。一条视频的想法如果只在脑子里,别人没法参与;写成分镜图之后,同事可以指出哪一镜不合适,拍摄的人可以提前准备道具。准备工作从一个人的事变成了可以协作的事。
如果只记一件事,那就记这一件:脚本要写到镜头级别,分镜要用来指导执行。这两句话做到了,从准备到成片的路径就是通的,剩下的只是执行得好不好的问题。

评论列表 (0条):
加载更多评论 Loading...