深夜十一点,一个做法式餐具的店铺运营盯着屏幕上刚跑完的四张主图。两张纯白底,两张木桌场景,她来回看了几分钟,最后把鼠标移回提示词输入框——问题不在图,在那句她随手敲下去的「生成商品图,好看一点」。
这句话在批量生图里太常见了。功能本身不复杂:上传一套商品参考图,写几条提示词,点一下创建任务,AI 按每条提示词分别生成对应风格的素材。可同样一套实拍图,有人写十条能拿到十套能直接上架的图,有人写十条拿回来的是十张「说不清哪里不对」的图。差别不在运气,在提示词有没有把该说的信息说完整。
这篇只讲一件事:一条批量生图提示词该怎么写,四要素分别怎么落笔,写完第一条之后为什么要点【添加】写第二条。看完你应该能把自己那句笼统的指令,改写成 AI 能稳稳听懂的分风格指令。

图1:一句随手写下的提示词,决定了后面十条素材能不能用。
一、批量生图里,提示词到底在指挥什么
先用一句话把批量生图这件事讲清楚。它的官方定位是:上传一套商品参考图,搭配多条差异化提示词,AI 分别生成对应风格、场景、版式的多张商品素材;一套参考图能批量产出多版本主图、场景图、细节图、规格图,不用重复上传原图。
先说清楚这个名字的含义。批量生图有两个入口,一个在青虎AI 工作台,走【创作】-【AI图像生成】-【批量生图】;另一个在 LinkPix 首页,走【图像生成】-【批量生图】。两个入口落到同一个弹窗,弹窗里分三块:参考图区、提示词区、参数设置。这篇要讲的提示词,就住在第二块里。
弹窗三块各管什么
参考图区管「产品长什么样」,最多上传 10 张;提示词区管「这张图要拍成什么样」,最多 10 条;参数设置管生图模式和比例尺寸,整批共用一套。三块分工清楚,写提示词时才不会把风格的要求误填到参数里。
再往下拆一层。参考图交给 AI 的是产品本体信息,用途是让 AI 认出这件货的造型、材质、颜色,所以上传时要确认图片产品主体清晰、无遮挡。提示词交给 AI 的是画面信息,用途是决定背景、光线、构图、风格。两者一硬一软,配合起来才出图。
换个角度理解会更清楚。参考图是「输入」,成图是「输出」,提示词就是中间那道转换规则。规则写得越明确,输出越可预期;规则写得越含糊,输出就越像抽签。批量生图能一次给你十套素材,前提是你给了它十个明确的规则,而不是十次试探。
更关键的一点是:批量生图里的每条提示词,对应的是生成一套独立风格的图片。它不是让你把十条需求堆进一条里,而是让你把十条不同风格的意思分开说。理解了这一点,写法就顺了——你要写的不是一段客户需求描述,而是十条各自成立、互不打架的分风格指令。
这也解释了为什么很多人卡在这里。他们习惯写「帮我做一个好看的商品图」,这在单张对话里也许还能对付,但在批量生图的逻辑下,这条提示词会把十条名额里的第一条浪费掉:AI 拿到了指令,却拿不到方向。
也正因为如此,青虎AI 在这个功能里把「提示词」单独做成一个可多条添加的区域,而不是让你在一段长文里分点。界面上的这个设计,其实是在提示你:把它当成十条独立指令来写,而不是一段需求描述来写。
提示词和参数是两回事
参数设置里管的是生图模式(默认「智慧模式」)和比例尺寸,那是全局口径,整批共用一套;提示词是逐条的、可以写十条的。别把「想要什么风格」写进参数,也别指望参数帮你定风格,风格这件事只在提示词里发生。
二、一条合格提示词的骨架:四要素
把那些能稳定出图的老手写的东西拆开看,会发现结构惊人地一致。一条好用的提示词,基本都包含四件事,缺哪一件,AI 就会在哪一件上自行发挥。
这四要素是:这是什么、要什么场景或风格、光线与调性、明确不要什么。
拿一个常见的例子说。假设你手上是一张保温杯的实拍图,最推荐的一条提示词长这样:
示例提示词
这是保温杯,生成纯白底商品主图,无文字无道具,主体居中。
这一句短,但四要素齐全。「这是保温杯」交代主体是什么;「纯白底商品主图」交代场景和风格;「主体居中」是构图与调性的要求;「无文字无道具」是明确告诉 AI 不要加什么。四句话各管一块,AI 接到的信息是完整的,出图才稳。
很多人第一次看到这个例子会觉得「就这么简单?」对,就这么简单。提示词的质量不靠字数堆,靠的是信息维度齐不齐。你把四要素说全,二三十个字就够;你四要素缺三件,写一百字也还是飘的。
三、四要素逐条拆开看
四个要素分别回答什么问题,写的时候该往哪儿使劲,漏了会出什么岔子——下面这张表把四件事摆在一起看,比单看文字清楚。
| 要素 | 它回答的问题 | 怎么写才到位 | 漏了会怎样 |
|---|---|---|---|
| 这是什么 | 画面主体是谁 | 直接说品类,如「这是保温杯」「这是帆布袋」 | AI 认不出主体重点,可能把货拍成道具的陪衬 |
| 要什么场景/风格 | 这张图用在哪里、要什么气质 | 白底主图、户外场景、居家氛围、轻奢静物,挑一个说清 | 背景随机,十条图可能十条各说各话 |
| 光线与调性 | 画面该怎么被打亮、整体感觉 | 柔光、自然光、暖调、冷调,挑贴合产品气质的一两种 | 光影跳脱,明明是同一款货却像不同品牌拍的 |
| 明确不要什么 | 哪些元素一定不能出现 | 无文字、无道具、无水印、不要复杂背景 | AI 自作主张加装饰,出图要返工 |
这张表里,前两行是「要什么」,后两行是「不要什么」和「怎么要」。新手的通病是把力气全花在前两行,写了一大堆好听的形容词,后两行一个字不写。结果就是画面大体对,但总有几个莫名其妙的小物件挤进构图里,或者光影方向前后矛盾。
举个具体的例子。有人写「这是香薰蜡烛,生成温馨高级的场景图」,前两要素有了,光线和禁忌都没有。跑出来可能是一张暖光客厅图,也可能是一张冷调卧室图,还可能背景里多出一本书、一盆绿植、一条丝巾。不是 AI 不听话,是它只能自己补。补得好是运气,补得不好是常态。把「光线与调性」和「不要什么」补上,同一句话的稳定性立刻不一样。
补一句关于「明确不要什么」的分量。四要素里它排在末位,但恰恰是最容易被忽略、又最影响成品率的一件。原因也简单:你不说,AI 就按自己的审美补全,补出来的东西未必是你想要的。把「无文字无道具」写在提示词末尾,是在给 AI 划一条边界线。
还有一点值得单独提:四要素的顺序建议固定。不是技术上必须,而是你写起来、改起来会快很多。固定顺序让每条提示词长得像同一个模具出来的,出错时一眼就能定位是哪个要素没写对。
四、把一句话改写成一条能用的提示词
道理讲完,看几组真实改写。左边是很多人实际写下去的版本,右边是按四要素补齐之后的版本,中间那一列是差别到底在哪。你会看到改动量其实很小,但成图的可用率天差地别。

图2:左边是「好看一点」,右边是四要素写全,两句话的差距就是成品率的差距。
| 口语版 | 四要素版 | 差别在哪 |
|---|---|---|
| 生成商品图,好看一点 | 这是保温杯,生成纯白底商品主图,柔光,无文字无道具,主体居中 | 补了主体、风格、光线、禁忌,方向从模糊变明确 |
| 来个高级点的 | 这是香薰蜡烛,生成轻奢静物图,侧逆光暖调,无文字无道具 | 「高级」被翻译成具体的风格词和光线词 |
| 做个户外场景 | 这是折叠椅,生成户外场景图,自然光冷调,背景简洁无人物 | 场景之外补了光线和背景要求,避免杂乱 |
| 换个背景 | 这是帆布袋,生成居家氛围感图,暖光柔和,背景无文字标签 | 把笼统的「换背景」换成具体氛围和禁忌 |
从表里能看出一个规律:口语版的毛病不是错,是「空」。AI 不知道你要什么,就只能自己猜,猜中靠运气,猜不中就得重跑。四要素版没有写得多复杂,它只是把该交代的都交代了,把猜测的空间压掉。
再补一个更贴近日常的判断口径:一条提示词写完之后,你自己读一遍,能不能在脑子里「看见」这张图长什么样。如果你读完还是模糊的,说明四要素里至少缺了一件;如果你读完能大概描述出背景、光线、构图,那这条提示词大概率能出好图。这个「脑内预演」的办法,比任何规则都直接。
有人会问,那是不是写得越细越好?未必。四要素是下限不是上限,把该说的说清之后,再往上堆细节,边际收益会快速下降,甚至互相打架。比如前面说了「纯白底」,后面又写「暖色木质桌面」,两条要求互相冲突,AI 只能二选一,结果反而更不可控。四要素说全、互不矛盾,就够了。
对照着改的时候,有个动作可以固定下来:写完一句话,回头数一数四要素齐了几件。齐两件以下的,基本可以判定这条提示词还不够,需要补。这个自查只要几秒钟,能挡掉一大半的返工。
五、写完第一条,点【添加】再写第二条
第一条写对了,接下来是批量生图真正的价值所在。在提示词输入框填完第一条,点【添加】,就会新增一个提示词输入框,你可以在里面写第二条、第三条。最多可以添加 10 条独立提示词,每一条都对应生成一套独立风格的图片。

图3:写一条、点【添加】、再写一条,十条提示词就是这样一条条落进独立输入框里的。
这里有个动作细节必须说清:很多人第一次用会以为十条提示词是「在一个框里分十行写」,于是把十条挤进同一个输入框,用逗号或者换行隔开。这样写 AI 只会当成一条超长指令处理,得到的是一套图,不是十套。正确做法是点【添加】,让每一条占一个独立输入框。
步骤一:写第一条
在提示词输入框按四要素写第一条,比如保温杯的纯白底主图。
步骤二:点【添加】
写完第一条后点【添加】,界面上会新增一个提示词输入框。
步骤三:写第二条
在新框里写第二条,换一个场景或风格,比如「这是保温杯,生成户外场景图,自然光,背景简洁无人物」。
步骤四:按需增减
最多可添加 10 条,按需增减、修改。不够就继续点【添加】,多了就删掉。
步骤五:核对后创建任务
确认原图、提示词、参数设置都完成后,点底部【创建任务】,系统自动计算消耗积分并一键执行。
五步里真正需要动脑的只有步骤一和三,也就是每条提示词怎么写。步骤二、四、五都是机械动作,点一下、删一个、核一遍。你会发现整件事的难度已经被收进了「四条提示词写得好不好」这一个点上。
关于【添加】这个动作,还有一个容易踩的细节:写完第二条之后,如果想改第一条,直接在原来的框里改就行,不用删掉重来。十条提示词都是可增可减、可改的,界面上给出的灵活性比很多人以为的要大。真正上了手会发现,写十条提示词的过程其实更像是写十行表格,一行一个方向,随时可以调整。
另外提醒一句,十条提示词不是硬性要写满。有的款只需要三条:白底、场景、细节,写完点创建任务就够了。名额是上限不是任务量,写几条取决于你要几套素材,不取决于能不能填满框。
还有个认知要掰正:十条提示词不是十条「同一句话的变体」,是十套各有用途的素材。第一条白底主图,第二条场景图,第三条细节特写,第四条规格图——它们各占一个坑,合起来才是一套完整的商品图库。这一点下一篇会专门讲名额该怎么分配,这里先记住一条:每条独立成风格,别让它们互相重复。
六、多条提示词怎么排,才像一套图
提示词写全之后,顺序也有讲究。同一批里十条提示词的排列方式,会直接影响你后面挑图、归档的效率。这里给一个可以直接套用的组织思路。
主图打头
前几条放平台要用的主图版本,白底打头,这是每个款的标配,优先级最高。
场景居中
中间几条放场景和氛围图,户外、居家、轻奢各占一条,用于详情页和种草。
细节垫后
后面几条放细节特写和多角度图,用于补充卖点、打消购买顾虑。
测试留尾
最后留一两条给风格测试,简约风、国风、ins 风轮着试,用来找投放方向。
这个「主图打头、场景居中、细节垫后、测试留尾」的排法,好处是结果回来之后你纵向一看就知道哪几条对应哪个用途,不用回头翻提示词记录。批量生图一次出的是几十张图,回来之后没有顺序感,挑图本身就成了负担。
再往细一层说,每条提示词之间的风格跨度也别拉得太大。同一批里从极简白底一下跳到浓烈国风,视觉上会显得这批素材不是一套的,投放时也难统一品牌感。反过来,如果十条全是白底,又失去了批量生图的意义。合适的做法是:主体风格框架保持一致,在这个框架内做场景和调性的变化。这也是青虎AI 强调「一套参考图派生多版本素材」的用意,图要成系列,不要各成一派。
还有一件事要提前想:十条提示词里,风格要和产品气质对得上。保温杯适合简约和户外,不适合过分华丽的场景;香薰蜡烛适合轻奢静物和暖调居家,不适合强促销的撞色。提示词写得再规范,风格和产品不搭,图出来也是别扭的。这是写之前值得花两分钟想的事情。
顺序和风格都定好之后,整套流程就跑通了:参考图给产品,四条提示词给方向,参数给统一口径,创建任务一键执行。真正决定这套图能不能用的,还是那十条提示词里有没有把四要素说全。
七、四个常见误区
下面四个坑,是写批量生图提示词时最常见的,踩了不致命,但会让你白跑一批。
误区一:把十条提示词挤进一个框
批量生图的十条提示词要靠点【添加】生成十个独立输入框,每条对应一套独立风格。挤在一个框里,AI 只会当成一条超长指令,你拿到的是一套图不是十套。
误区二:只写「要什么」,不写「不要什么」
四要素里「明确不要什么」看着最不起眼,却是压掉 AI 自由发挥的关键。不写「无文字无道具」,画面里就容易多出你不需要的东西。
误区三:以为写得越长越专业
提示词的质量看信息维度,不看字数。四要素齐全的二三十个字,胜过大段堆砌形容词却没交代光线和禁忌的百字长句。
误区四:十条写成一个模子
十条提示词如果只换了个别词,出来的图会高度接近,等于十套名额只换来一套素材。每条要有明确的用途区分。
这四个误区有个共同的根子:把批量生图当成了「单张出图的对话工具」。它不是。它是按条执行的批量流水线,你给的每一条指令都会独立跑出一套结果,所以每条指令都必须自己站得住。想通这一点,四个坑基本都能绕开。
八、四个写提示词的提效技巧
同样一个功能,写法的差别会让一天的产出差出一截。下面四条是可以直接照搬的。
技巧一:四要素当模板套
把「这是什么 + 要什么场景/风格 + 光线与调性 + 不要什么」当成固定句式,写每条时按这个顺序往下填,速度快,也不容易漏项。
技巧二:先写骨架,再换变量
把批内不变的部分(比如「无文字无道具」)固定下来,只替换场景和调性两个变量。这样十条之间有共性也有差异,风格不打架。
技巧三:拿两张图小批试跑
新品类、新风格第一次写,先用两条提示词小批跑一遍看效果,确认方向对了,再把十条补满。省掉一整批无效的返工。
技巧四:把好用的提示词存下来
跑出满意结果的那几条提示词,单独存一份。下次遇到同类产品,改个主体名就能复用,不用从头再想一遍。
这四条没有一条需要额外成本,差别只在于写之前想没想。把批量生图用顺的人,往往不是点子最多的,而是提示词写得最有章法的。
九、三个能直接照做的场景
抽象讲完,说三个具体到能照着写的场景。这三种基本覆盖了日常大批量出图的需求。

图4:一批货、几张样张,写提示词的过程就是给每种产品定方向的过程。
场景一:单款多版本主图
一个保温杯要同时上淘宝和跨境平台,用四条提示词分别写纯白底主图、户外场景图、轻奢静物图、细节特写图,一次拿到四个版本的素材,按平台各取所需。
场景二:同系列多款铺量
同系列五款帆布袋,每款一套参考图,各自写三条提示词(白底、居家、户外),风格骨架保持一致,只换主体和调性,整批出图视觉上是一套完整的系列。
场景三:新品素材备货
新品上架前,用一张实拍原图派生六条提示词,覆盖详情页所需的白底图、场景图、细节图、规格图,一次性把整套素材备齐,不用为新版式重新拍。
这三个场景的共同点是:产品只有一套实拍图,但要的素材版本很多。批量生图接的就是这种活——参考图不变,靠提示词把「一套图」派生成「一套素材库」。以前这种活要么靠反复拍,要么靠美工一张张修,现在的工作量集中到了写提示词这一步。
还有一层价值常被忽略:提示词写好了,本身就是资产。一套验证过的四要素句式,换个产品名就能接着用,越用越顺。这跟每次从零想一句「好看一点」相比,长期看省下的是实实在在的时间。青虎AI 把提示词做成可增可减、可修改的独立条目,也正是为了方便你把这套句式沉淀下来、反复使用。
需要顺带说明的是,批量生图和青虎AI 图像生成里的其他同族功能定位不同:有的专做批量改图,有的专做批量译图,有的专攻电商主图复刻或详情图复刻。日常说的「一次出一批不同风格的素材」,对应的就是批量生图这一条线。认准功能,再用四要素的写法去喂它。
把这三个场景摆在一起看,会发现它们共同指向一个结论:出图效率的瓶颈,早就不在工具会不会用,而在你能不能让每条提示词都带上明确的方向。方向给得越清楚,一次跑出来的可用素材就越多,返工就越少。这也就是为什么值得在写提示词这件事上多花几分钟。
十、总结
总结:提示词写四件事,每条独立成一个风格
批量生图的提示词不靠文采,靠信息完整。一条合格的提示词说清四件事:这是什么、要什么场景或风格、光线与调性、明确不要什么。写完第一条,点【添加】写第二条,最多可添加 10 条独立提示词,每条对应生成一套独立风格的图片。参考图锁定产品,提示词定义风格,参数统一口径,最后点【创建任务】一键执行。把这套写法固定下来,青虎AI 的批量生图就能从「碰运气出图」变成「按计划出图」。
十一、常见问题解答
问:批量生图的提示词在哪里填?
答:进入批量生图弹窗后,在提示词输入框里填写单条作图指令,示例写法是「这是xxx,生成纯白底商品主图」。
问:一条提示词推荐怎么写?
答:按四要素写:这是什么、要什么场景或风格、光线与调性、明确不要什么。例如「这是保温杯,生成纯白底商品主图,无文字无道具,主体居中」。
问:怎么写第二条提示词?
答:写完第一条后点【添加】,界面会新增一个提示词输入框,在新框里写第二条即可。
问:最多能写几条提示词?
答:最多可添加 10 条独立提示词,每条对应生成一套独立风格的图片,可按需增减、修改。
问:提示词需要写多长?
答:长度不是关键,四要素齐不齐才是。二三十个字把四件事说清,比一百字只堆形容词有效得多。
问:提示词里要不要写「不要什么」?
答:建议写。「无文字无道具」这类禁忌是压掉 AI 自由发挥的关键,能让出图更接近你要的样子。
问:参考图要上传几张?
答:单次最多上传 10 张参考图,上传后确认图片产品主体清晰、无遮挡,这样 AI 识别产品造型才准确。
问:生成模式和提示词是一回事吗?
答:不是。生图模式在参数设置里,默认「智慧模式」,是整批共用的全局口径;提示词是逐条的,管的是风格和场景。
问:提示词写完怎么执行?
答:确认原图、提示词、参数设置全部完成后,点底部【创建任务】,系统自动计算消耗积分并一键执行。
问:比例尺寸在哪里调?
答:在参数设置里,根据电商平台选择对应的比例尺寸即可。
问:十条提示词都写同一风格行不行?
答:可以写,但结果会高度接近,等于十套名额只换来一套素材。建议每条对应不同的场景或用途。
问:批量生图和套图生成有什么区别?
答:批量生图靠多条提示词分别产出不同风格、场景、版式的多张素材;青虎AI 图像生成里还有其他同族功能,适用的活不同,按自己的需求选。

评论列表 (0条):
加载更多评论 Loading...