一个做女装的运营,花了半天时间做了一张封面图。她在图上排了三行字:「秋冬新款」「显瘦不挑人」「限时福利」,字号都做得很大,字体还挑了手写体,配上模特全身照,成品放在电脑屏幕上看着很有设计感。视频发出去三天,播放量一直上不去。
她把手机拿过来重新看了一遍。视频在信息流里出现的时候,封面缩略图只有指甲盖那么大,三行字糊成三团浅色的影子,模特的脸和衣服都看不清。她放大成品图才认出来,第一行的第二句字被自己的手写体连在一起,缩略之后彻底成了一团。
封面这个位置的麻烦在于:它的成败由一张被缩小了很多倍的图决定,而做图的人始终在看原图。原图上清晰的字,缩略之后未必清晰;原图上分明的层次,缩略之后可能全部糊成一片。
这篇内容讲清楚五件事:封面缩略图的实际展示尺寸有多大、文案字数上限怎么定、字号与对比度怎么保障、文字和商品的位置关系怎么摆、以及用青虎AI 替换封面时的具体操作。

图1:同一张封面,两个尺寸下是两种效果
一、缩略图有多小:先认清这件事
做封面时的第一反应往往是「填满」,因为原图很大,留白显得浪费。但封面在信息流里的实际占位很小:竖版视频的缩略图,宽度往往不到手机屏幕宽度的三分之一,高度按比例跟着缩。一张一千多像素宽的成品图,落到用户眼前时剩下的宽度可能只有两三百像素。
这个比例意味着什么?原图上一个字高四十像素,缩到展示尺寸之后字高只剩十像素上下。这个尺寸下人眼还能辨认出字形,但已经辨认不出笔画的细节。手写体、艺术字、带描边的字、颜色和背景接近的字,都在这一步失去可读性。
还有一个常被忽略的因素是环境。用户刷信息流的时候,手机往往拿在手上、距离眼睛不远,但屏幕上同时有很多内容在竞争注意力,滑动速度也快。一张封面能获得的注视时间往往只有零点几秒。在这个条件下,用户不是在读,而是在扫。
既然用户是在扫,封面要完成的就不是「把信息说完」,而是「让人在三秒内认出这是什么商品、值不值得点开」。这两件事对文案的要求完全不同:前者要求信息全,后者要求信息少而重。
二、字数上限怎么定
封面文案的字数上限不是一个固定数字,它取决于这张图最终会被展示到多小、以及你希望用户在什么距离上读懂。按上面的缩小比例往回推,可以得出一组比较实用的档位。
| 文案规模 | 缩略后的可读程度 | 适合的用法 |
|---|---|---|
| 六到十个字,一行 | 偏高,扫一眼就能读完 | 最稳的一档,适合绝大多数封面 |
| 十到十六个字,一到两行 | 中等,需要停一下才读完 | 商品名称加一件具体的事 |
| 十六字以上,三行及以上 | 偏低,容易糊成一团 | 不建议,缩略后基本失去作用 |
表里的字数按中文字符算。更实用的判断标准是行数:一行最稳,两行是上限,三行就要重新想。原因是每一行都会把字号压小一点,行数越多,单行的字越小,而缩略图里最先失去可读性的就是小字。
还有一个容易踩的坑是把信息拆成多段短句。三行两句、每句四个字的排法,看起来每句都短,实际上整体占到三行,字号和行距都被挤掉。真正省事的做法是把最想说的那件事压成一句,其他的信息交给视频内容去讲。
字数上限可以按最小展示位来定
如果同一条视频要投到多个位置,拿其中展示得最小的那个位置当标准。按那个位置的尺寸去看一眼缩略效果,字还能不能看清,就是这张封面的及格线。按最大的位置定文案,投到小位置上往往会糊。

图2:封面文案的死线,就是最小那个尺寸
三、字号下限与对比度
字号的判断有个反直觉的地方:做图时觉得「已经很大了」,是因为比对的是随手打的默认字号,而不是商品在画面里的大小。把主文案的字高和商品高度放在一起看,才知道够不够。
一个可操作的下限是:主文案的字高不低于整图宽度的十二分之一。按这个比例,缩略到展示尺寸之后,字高大约还剩下十个像素上下,扫的时候能认出字形。副文案如果要写,字高不低于主文案的三分之二,再小就没有存在的必要了。
| 要素 | 档位要求 | 不达标时的表现 |
|---|---|---|
| 主文案字高 | 不低于整图宽度的十二分之一 | 缩略后字形糊在一起,认不出 |
| 副文案字高 | 不低于主文案的三分之二 | 缩略后成为一道浅色痕迹 |
| 文字与底的明度差 | 偏高,深浅明显分开 | 字跳不出来,像贴纸一样浮在画面上 |
| 字体笔画粗细 | 偏粗,无繁琐装饰 | 细笔画在缩小时直接消失 |
对比度这一项比字号更容易出问题。判断办法很直接:把成品图缩到拇指大小,眯着眼看,如果文字和背景分不开,说明对比度不够。常见的补救方式有两种,一是给文字垫一个颜色块,让文字和底色之间有一层稳定的差;二是调深或调浅文字颜色,避开和背景接近的那一段明度。
字体选择上,笔画粗细均匀、结构方正的字缩略后存活率更高。带装饰的字体、手写体、弧形排列的文字,在小尺寸下会互相粘连。这不是美不美观的问题,是能不能被认出来的问题。
四、文字和商品的位置关系
封面里有两个主体:文字块和商品。这两个东西挤在同一个画面里,位置关系没摆好,就会互相削弱。一个基本排法是分区:文字集中在一侧,商品主体留在另一侧,两者各占一块,中间留出过渡。
最需要避免的是文字压在商品主体上。压在商品上的文字会让商品被切成几块,用户既看不清商品是什么,也不容易读字。如果商品必须居中,就把文字放到上方或下方的一段横向区域,避开主体所在的那一块。
四个角也要留出余地。画面上可能出现平台自动叠加的标识,位置往往靠近边缘。文字贴着角落放,容易被标识盖住一部分,读起来就是残缺的。
位置关系可以按版式固定下来
同一个店铺的内容,封面版式统一比每张各出花样更省事。把文字固定在左侧三分之一、商品放在右侧,做成一个模板,每次只换文案和商品图。版式固定之后,判断封面好不好就只剩「字够不够大、能不能看清」这一件事,不用每次都重新想构图。
第一步:确定商品主体的位置
先把商品在画面里摆定,确定它占据的是左、右还是中间哪一块,以及它的轮廓边界在哪里。这一步定下来,剩下的都是给文字找地方。
第二步:给文字划出一块不重叠的区域
在商品轮廓之外划一块区域给文字,可以是竖版视频的左侧三分之一,也可以是下方的一条横向带。区域边界要和商品轮廓拉开一点距离,不能贴着走。
第三步:缩到最小尺寸看一遍
把成品图缩到信息流里那个实际大小,检查三件事:字能不能认出、商品能不能认出、两者有没有互相压住。看不清就调字号或换位置,不要靠感觉判断。
第四步:避开四个角的边缘区域
文字块不要顶到画面边缘,四角各留出一段空白。这一段空白是给平台标识和裁切留的余量,也是让画面显得不拥挤的余量。
五、点击引导:说清「这是什么」更有效
做封面的人常常想用悬念拉点击,比如一行「你猜它是什么」或者「这点很多人不知道」。这个思路在图文标题上或许有用,在封面缩略图上往往失效,原因在于用户没有上下文:标题有前后文可以猜,封面就是一格画面,猜不出任何东西。
更稳的做法是明说。一行文案里放两样东西:一个品类方向的词,加上一件具体的事。用户扫到之后能立刻判断「这是个什么东西」和「它有什么值得一提的地方」,才有理由点开。含糊的表达省下的是信息,丢掉的是点击。
明说型
直接点出商品类别和它的一个特点,用户可以立刻判断这跟自己有没有关系。缺点是不够新奇,优点是理解成本最低,缩略之后依然成立。
疑问型
用一句提问引起注意,比如从使用场景切入。它比明说型多一层勾子,但前提是问题本身要让人一眼看懂,否则缩略之后只剩一堆认不出的字。
悬念型
故意不说明是什么,靠留白制造好奇。在缩略图这个尺寸下风险最高,用户看不懂是什么,多数会直接划走,没有耐心去猜。
三种方式在缩略图尺寸下的表现差别很明显。明说型的信息在缩小之后依然保留,疑问型保留一半,悬念型最容易归零。如果只能用一句话,明说型是更保险的选择。
还有一点和内容本身有关:封面说法和视频里讲的东西要对得上。封面承诺了一件事,视频里从头到尾没提,用户点开之后很快退出,封面带来的点击价值也会被抵消。封面是视频内容的入口,不是它的广告。
六、用青虎AI 替换封面:四步操作
封面文案定下来之后,剩下的动作是把这张图或者视频里的最佳画面替换上去。青虎AI 的【修改视频封面】功能提供两种方式,一种是从视频内部选帧,一种是上传自定义图片,操作按四步走。
步骤一:进入功能
打开青虎AI,选择【修改视频封面】功能,进入操作界面。
步骤二:上传视频
上传需要修改封面的视频文件。功能支持批量上传视频并批量替换封面,多个视频需要处理时不必逐个来。
步骤三:选择封面方式
两种方式二选一。视频内部选帧时,AI 会自动分析视频每一帧的画面质量、冲击力和吸引力,推荐最佳封面帧,你也可以手动浏览视频帧,自己挑选心仪的画面;自定义上传时,把准备好的封面图上传上去,AI 会自动调整图片尺寸和格式以匹配视频。
步骤四:确认并替换
选定封面帧或上传图片之后,点击确认一键替换封面,整个过程很快完成。

图3:两种封面方式走的是同一条替换路径
替换封面只改变展示时用的缩略图,视频内容完全不变,这是这个功能最让人放心的一点:不必为了换一张封面去重新导出视频,也不必担心画面或者配音被动过。主流平台如抖音、小红书、快手等都支持自定义封面,换上去之后按平台的节奏生效。
手工逐帧找一个画面是很耗时的动作。一段八秒的视频有二百四十帧,一帧一帧看过去,眼睛很快就疲劳,判断也会变钝。让 AI 先给出推荐帧,再在候选里挑,效率差别不小。
七、四个封面文案的误区
误区一:按原图效果判断文案是否清楚
做图和看封面是两个尺寸。原图上清楚的文字,缩略之后可能连成一片。判断标准应该放在最小展示尺寸上,看一眼缩略效果,比在原图上反复调字号有用得多。
误区二:用花体或艺术字提升设计感
装饰性强的字体在小尺寸下笔画会互相粘连,设计感保留不下来,可读性反而没了。笔画均匀、结构方正的字缩略后存活率更高,这一条比美观优先级更高。
误区三:把文字压在商品主体上
文字压在商品上,用户既看不清商品是什么,也不容易读字,两个主体互相削弱。把画面分区、文字集中在一侧,画面反而更干净,商品也更突出。
误区四:用悬念代替说明
封面缩略图没有上下文,用户看不懂是什么的时候,多数会直接划走。留悬念是图文标题的思路,封面这个位置上,说明白比藏起来更有效。
四种做法的共同点是都把判断建立在原图或者自己的理解上,而没有放到用户实际看到的那一格里去想。封面文案的检验标准只有一个:缩到最小,还能不能一眼认出来。
八、四条让封面更好读的习惯
习惯一:做成图后必缩一遍看
成品导出之前,把它缩到信息流里的实际大小看一次。这一步花不了多少时间,却能拦下大部分字号过小、对比不足的问题。
习惯二:文案先写字数再写内容
先把字数框定在一行十个字以内,再往这个框里填内容,而不是先写出想说的话再想办法缩小。顺序反过来,文案会越改越长。
习惯三:同一视频备两种封面
同一个视频可以准备两种封面,一种偏信息型、一种偏画面型,投到不同位置上看表现。封面替换成本很低,多备一版是划算的。
习惯四:把封面和视频前几秒对上
封面说的是什么,视频开头几秒最好也在说什么。用户点进来立刻接上,才不会马上退出。封面和内容对上,点击的价值才能留下来。
四条里最省力的是第一条。它不需要额外的设计能力,只需要一个动作:把图缩小,然后自己看一眼。多数封面问题在这一眼里就会暴露出来。
九、三个封面改造场景
场景一:三行字砍成一行
一个做数码配件的运营,原来的封面有三行字:品牌、型号、卖点。缩略之后只剩模糊的三团色块。他把两行删掉,只留一句说明这是什么,字号放大到占满左侧三分之一,商品放在右侧。改完之后信息少了,认出来的东西反而多了。
场景二:从视频里挑一帧当封面
一个做食品的团队,封面用的是自制的合成图,效果一直平淡。他们改为从视频内部选帧:让 AI 分析每一帧之后给出推荐的封面帧,再在候选里挑一帧产品近距离展示的画面。选出来的画面和视频内容天然一致,点开之后也不会觉得被误导。
场景三:批量替换同一批视频的封面
一个做家居百货的卖家,有一批同一系列的商品视频,原来的封面都是各自随机首帧,风格不统一。他把这批视频一次性上传,用同一张风格统一的封面图批量替换。系列内容在信息流里的辨识度一下就出来了。
三个场景的做法不一样,判断标准是同一个:用户扫过那一格的时候,认不认得出这是什么。批量替换的场景更说明这一点——统一比花样重要,用户在信息流里认出「又是这个系列」,比每一张封面各说各话更有价值。

图4:同一批视频用统一的封面,在信息流里更容易被认出来
十、四个要求的速查对照
把前面几节的结论收成一张表,做封面的时候放在旁边对照,比临时回忆省事。
| 要求 | 参照标准 | 验证方式 |
|---|---|---|
| 字数上限 | 一行六到十个字,两行为上限,不写三行 | 数行数,超两行就重写 |
| 字号下限 | 主文案字高不低于整图宽度的十二分之一 | 与商品高度放在一起比 |
| 对比度 | 文字与底的明度差偏高,深浅明显分开 | 缩到拇指大小眯眼看 |
| 位置关系 | 文字集中一侧,不压商品,不贴四角 | 看商品轮廓有没有被切断 |
| 表达方式 | 说清这是什么,加一件具体的事 | 找人只看一秒,问他看懂了什么 |
最后一行那个验证方式最直接。把封面缩略图给别人看一眼,一秒后关掉,问他记住了什么。回答接近你原本想说的,说明封面成立;回答不上来,说明还有信息没被看到。这个方法不需要专业眼光,也不用懂设计。
十一、总结
总结:先缩到最小尺寸看一遍,再决定写多少字
封面在信息流里的实际展示尺寸比原图小很多,竖版缩略图的宽度往往不到手机屏幕宽度的三分之一,这个比例决定了封面文案的写法。字数按行数控制:一行六到十个字最稳,两行是上限,三行缩略之后基本失去作用。字号上,主文案字高不低于整图宽度的十二分之一,副文案不低于主文案的三分之二,笔画要粗、结构要方正,花体和手写体在小尺寸下容易粘连。对比度要够,判断办法是把图缩到拇指大小眯眼看,文字和背景分不开就加一层底色或者调整颜色。位置关系上把画面分区,文字集中在一侧,不压商品主体,四个角留出余量避开平台标识。点击引导用明说型:一个品类方向的词加一件具体的事,比制造悬念更稳,封面说法还要和视频内容对得上。要改封面时,用青虎AI 的【修改视频封面】功能:打开青虎AI 后选择【修改视频封面】,上传视频,接着二选一——让 AI 分析每一帧并推荐最佳封面帧,或者自己手动浏览视频帧挑选;也可以上传自定义封面图,由 AI 自动调整尺寸和格式以匹配视频;确认后点击一键替换。功能支持批量上传视频并批量替换封面,替换只改缩略图,视频内容完全不变。四个常见误区是按原图效果判断、用花体字提升设计感、把文字压在商品上、用悬念代替说明。封面这一格画面很小,能放下的东西也少,把它当成一句话而不是一段介绍来写,反而更有效。
十二、常见问题解答
问:视频封面文案写多少字合适?
一行六到十个字最稳,十到十六个字可以分一到两行,超过十六个字就不建议了。判断标准是行数:一行最稳,两行是上限,三行缩略之后基本糊成一团。
问:为什么原图上很清楚的文案,发出去就糊了?
因为展示尺寸和原图尺寸差很多。竖版缩略图的宽度往往不到手机屏幕宽度的三分之一,原图上的字缩小之后只剩几到十几个像素高,笔画细节会消失。导图前把成品缩到实际大小看一遍,就能提前发现。
问:封面的字号有没有下限?
可以按比例控制:主文案的字高不低于整图宽度的十二分之一,副文案不低于主文案的三分之二。再小就没有存在的必要,缩略之后会变成一道浅色痕迹。
问:文字颜色怎么选才够清楚?
核心是文字和底的明度差要够,深浅明显分开。如果背景杂乱,给文字垫一个颜色块,让文字和底之间有一层稳定的差。判断办法是缩到拇指大小眯眼看,分不开就说明不够。
问:文案压在商品上可以吗?
不建议。压在商品上的文字会切断商品轮廓,用户既看不清商品,也不容易读字。把画面分区,文字集中在一侧、商品留在另一侧,两个主体各占一块更清楚。
问:封面写悬念式文案是不是点击更高?
在缩略图这个尺寸下风险偏高。封面没有上下文,用户看不懂是什么的时候多数会直接划走。明说型更稳:一个品类方向的词加一件具体的事,用户能立刻判断跟自己有没有关系。
问:封面和视频内容不一致会有什么影响?
用户点开之后发现内容和封面说的不是一回事,容易很快退出。封面带来的点击价值会被抵消,长期还会影响用户对账号的判断。封面应该是内容入口,不该承担内容之外的说法。
问:改封面会影响视频内容吗?
不会。替换的只是展示时用的封面图,也就是首帧缩略图,视频内容完全不变,不需要重新导出视频。
问:能在青虎AI 里自己做封面吗?
可以上传自定义图片作为封面。青虎AI 的【修改视频封面】功能支持两种方式,一种是从视频内部选帧,一种是上传自定义封面图,上传后 AI 会自动调整图片尺寸和格式以匹配视频。
问:从视频里选帧要一帧一帧看吗?
不需要自己全部看一遍。AI 会自动分析视频每一帧的画面质量、冲击力和吸引力,推荐最佳封面帧,你在候选里挑就行。也可以手动浏览视频帧,自己选择心仪的画面。
问:多个视频能一次改封面吗?
可以。功能支持批量上传视频并批量替换封面。同一系列的商品视频用统一风格的封面,在信息流里的辨识度会更高。
问:主流平台都支持自定义封面吗?
抖音、小红书、快手等主流平台都支持自定义封面。替换完成后按各平台的节奏生效。有一点要注意,平台可能自动叠加播放标识,文案避开画面四角可以防止被盖住。
回看开头那位运营,她的封面不是做得不好看,是好看建立在原图尺寸上。三行字在原图上排得舒服,缩到那一格里就只剩三团影子。她后来的做法很简单:把两行删掉,只留一句说明这是什么,字号放大到商品的一半高,缩到手机上看了一眼,认出来了。
把字号、字数、对比度、位置这四件事按缩略图的尺寸定下来,剩下的部分交给工具就顺手了。青虎AI 的【修改视频封面】把替换这一步压到了「上传视频、选帧或上传图片、点确认」,两种方式都能用,批量视频也能一起处理,替换只改缩略图不动内容。这些能力真正的价值,在于让你可以反复换几次、试试哪一版在第一眼里更清楚。
如果只记一件事,就记这一条:封面的判断标准不在你的电脑屏幕上,在那张被缩小了很多倍的缩略图里。先缩小看一遍,再决定上面放几个字。

评论列表 (0条):
加载更多评论 Loading...