晚上八点多,一个做女装的运营把新到的五款样品摊在桌上,用手机一盏一盏地拍。拍完往电脑里一导,发现有两张逆光拍糊了,还有一张旁边放着上一款的样品没挪走。她当时没在意,觉得能看清楚就行,结果图传上去跑出来,糊的那两款产品边缘全是重影,混了样品的那个款干脆把两件衣服的特征揉在了一起。
这一类返工,几乎每个做批量出图的人都遇到过。问题不在提示词写得不好,也不在参数选得不对,而是在最开始那三秒钟——你把什么样的图交给了青虎AI。
上传这个动作门槛很低,低到大多数人不会在它上面停顿。但它是整条链路的第一道闸门,闸门放进来什么,后面就只能处理什么。这篇专门讲这一步:上传区在哪、点哪个按钮、什么样的图能上、什么样的图要先换掉,以及为什么单次是 10 张这个数。

图1:上传前把图理一遍,比出问题后再返工划算得多。
一、上传这一步,定的是整批图的天花板
很多人把批量生图当成一个「输入指令、等待出图」的黑盒,注意力全在提示词上。实际顺序不是这样。AI 要先通过你上传的参考图认识这个产品——它的造型、材质、颜色、比例、结构,全部来自图片本身。图上没拍清的部分,它只能靠猜;图里混进去的东西,它可能当成产品的一部分。
这就带来一个不太直观但很重要的结论:提示词写得再好,也补不回参考图里丢掉的信息。你写「生成纯白底商品主图」,AI 知道要白底,但它不知道这个产品的扣子是三颗还是四颗——那三颗扣子的信息,只能从你的原图里来。原图里看不到,出来的图里也就没有。
所以上传这一步的定位,可以用一句话概括:它不是「把素材丢进去」,而是「给 AI 一份准确的产品说明书」。说明书越清楚,后面所有提示词跑出来的结果越稳。这一步的投入产出比,远高于在提示词上反复雕琢。
为什么这一张图值得单独挑
批量生图会基于你给的参考图识别产品,再按提示词变换风格和场景。产品识别得准,风格变化才不会把主体带跑偏。因此挑图这件事不是「顺手」,而是必要前提。
换个角度看会更清楚。同一批参考图,配同一批提示词,如果参考图从模糊换成清晰,出来的成品质量会有肉眼可见的差距;反过来,参考图不变,提示词从普通改成精雕细琢,差距往往没那么大。投入精力的顺序,应该是先图后词。
还有一点值得说清:上传这个动作是不可回退的起点。你可以改提示词、可以换参数、可以重跑,但如果你交出去的图本身就是错的,后面每一轮都是在错的基础上加工。把这一步做扎实,是后面所有环节省心的前提。
二、上传区在弹窗的哪个位置,点哪个按钮
进到批量生图的操作弹窗之后,参考图区就在偏上的位置。这一块区域的作用很单一:展示你这次要处理的商品图,告诉 AI 它要认识的是哪一个产品。区域里会有一个上传入口,点【上传图片】,从本地把商品实拍图选进来就行。
操作本身没有多余步骤,选图、确认、等缩略图出现,就完成了。上传之后区域里会出现对应的缩略图,你可以在这里直观看到这一批到底放了哪几张。这个缩略图视图是后面所有核对动作的基础,别跳过它。
有个位置上的细节值得留意:参考图区和提示词区、参数区是分开的三块,别把要处理的图和要写的指令混着填。参考图区只放图,指令写在提示词区。弄清楚这一点,弹窗里就不会手忙脚乱。
如果你是从工作台进的,路径是左侧【创作】-【AI图像生成】-【批量生图】;从 LinkPix 进的话,走首页【图像生成】-【批量生图】,两条路进的是同一个弹窗,参考图区的位置也一样。青虎AI 把两个入口做成一致的操作界面,就是为了让你不管从哪扇门进来,看到的都是同一套动作。
三、什么叫「主体清晰、无遮挡」,给一个能对照的标准
官方对参考图的要求说得很简洁:上传后要确认图片产品主体清晰、无遮挡。这九个字听着好懂,真正挑图的时候还是容易含糊。把「清晰」和「无遮挡」拆成可对照的几条,挑图就有了准绳。
| 检查项 | 合格的样子 | 不合格的样子 |
|---|---|---|
| 主体完整 | 产品整体在画面里,边缘没有被切掉 | 只拍到半个产品,或者边角出画 |
| 对焦清楚 | 产品轮廓锐利,纹理和细节看得清 | 整体发虚、边缘有拖影 |
| 无遮挡 | 产品表面没有手、包装、别的货压着 | 手握着拍、被道具挡住一角 |
| 光线均匀 | 明暗过渡自然,没有大面积死黑或过曝 | 逆光成剪影、强反光吃掉细节 |
| 主体单一 | 画面里只有这一个产品是主角 | 同框出现好几款,分不清要出哪个 |
这五条里,四条是「有或没有」的判断题,只有「光线均匀」稍微需要眼力。挑图的时候照着从上往下扫一遍,就能筛掉大部分不合格的素材。这个动作看起来笨,但比出了图再回头找原因快得多。

图2:左边是能直接上传的图,右边是必须先换掉的图,差别一眼就能看出来。
还有一条隐含要求:图的清晰度要够。太大的可以压,太小的放不大。手机正常拍摄、光线正常、对焦正常拍出来的图,基本都能用;截图、聊天的转发图、压缩过好几遍的图,往往在清晰度这一关就已经不合格了。
把这张表当成一个固定的自检清单,每次挑图前扫一遍。用几次之后你会形成条件反射,拿着一张图看一眼就知道能不能用,效率比逐条对照更高。
四、为什么正面清晰照是最省事的选择
如果手上有多个角度的图,优先传正面清晰照。原因不复杂:正面视角下,产品的造型、比例、主要特征一次性全在画面里,AI 提取特征时不需要额外推断。斜着拍的图能看出一部分特征,但被挡住的那一侧,AI 只能靠推测。
这不是说斜角图不能用,而是说同样条件下,正面图的结果更可控。尤其是结构比较规整的产品,比如方形的包装盒、有固定轮廓的家电、有明确对称结构的日用品,正面图给出的信息密度最高。你把它交出去,AI 认识得最快、最准。
优先正面图
产品特征一次看全,AI 不用靠推测补全看不见的部分。
主体占画面要够大
产品在画面里占得太小,特征信息就少,放大还容易糊。
背景尽量干净
杂乱背景是干扰信号,可能被当成产品结构的一部分。
一款一图
一个画面只留一个主角,多个产品同框会让识别变含混。
一个实用的挑图顺序
先看有没有正面清晰照,有就直接用它;没有的话,从现有图里选拍摄角度最正、产品占画面比例最大、背景最干净的那一张。这个顺序能让你在十几张图里快速定下主图,不用反复犹豫。
再往前一步:如果这个产品有正反面两个重要面,而你要出的图需要同时体现,那么考虑把它们作为不同的参考图分开处理,或者干脆分两批。把两个面的特征硬塞给一张参考图,反而会让识别变得含混。
选图时还有个常被忽略的点:产品在画面里占的比例。占得太小的图,产品主体信息少,放大之后还容易糊;占得太满、边角贴边的图,又可能被裁到。理想状态是产品完整清晰地占据画面主体部分,四周留一点余白。
五、三类拖后腿的图,看清它们为什么会坏结果
下面这三类图是实际使用中最常见的「隐形坑」。它们的共同点是:看上去问题不大,传到结果里才暴露。
| 图的类型 | 表面上看着怎样 | 会带来什么后果 |
|---|---|---|
| 斜角、俯拍过度的图 | 有立体感,看着挺专业 | 背面和被遮挡部分的信息缺失,特征提取不完整,成品容易出现变形或臆造细节 |
| 模糊、逆光、压缩过的图 | 轮廓还在,大概能认出来 | 边缘细节丢失,AI 抓不到准确轮廓,出的图边缘发糊、材质失准 |
| 多主体混放的图 | 一图多用,省事 | 画面里好几个产品,AI 分不清主角,特征被揉在一起,成品像「杂交」 |
第三类问题最容易被低估。很多人拍图时习惯把一个系列摆在一起拍一张全景,觉得反正都是一个系列的,一起传上去应该也没事。但 AI 拿到这张图,看到的是多个主体,它无从判断你要出的是哪一个。结果就是特征混在一起,出来的图既不像 A 也不像 B。
第二类问题则更隐蔽——你在小屏上看缩略图,可能觉得挺清楚的,但放大到实际尺寸就发现边缘全是糊的。一个简单的自检办法:把图片放大到看起来和产品实物差不多大,如果这时候边缘还能保持锐利,那它的清晰度就够用;如果放大之后明显发虚,别用。
第一类问题不是绝对不能用,而是要有意识地选。如果你的产品正面特征已经足够表达它的全部信息,斜角图也无妨;如果它靠侧面的结构才能分辨,那斜角图的信息就可能不够,这时应该补一张正面图,而不是硬用。
还有一类图容易被忽略:产品被包装盒或塑料膜包着拍的。透明包装会反光,反光会盖掉产品表面的细节,这类图能拆包装重拍就重拍,实在不行再考虑别的角度。
六、单次最多 10 张:这个上限怎么用才不浪费
参考图区有一个明确的上限:单次最多上传 10 张。这是硬边界,超了传不进去。第一次碰到这个数的人,反应往往两极——要么觉得太少了不够用,要么觉得凑不满心里不舒服。两种反应都不太对。
先说「凑满」这件事。10 张是上限,不是目标值。一个产品如果一张正面清晰照就足够,那就传一张,多出来的空位不会带来额外好处。传进去的每一张图都应该有它的作用——要么补充一个角度,要么体现一个细节。凑数的图只会稀释有效信息。
再说「不够用」。如果你的需求确实超过 10 张,说明这个量级本来就不适合一次跑完,这时候拆批是正确的做法,而不是妥协。按产品、按系列、按平台把物料分成几组,每组控制在 10 张以内,一批跑完再跑下一批,反而更容易发现哪一批出了问题。
上限背后的逻辑
一批参考图通常配的是同一组提示词和同一套参数。图越多,这一组条件要同时罩住的差异就越大;控制在 10 张以内,这批图之间的一致性更容易保证,结果也更稳定。
实操上一个好用的切法:按「这一批的提示词能不能对每张图都成立」来分组。如果同一句指令对你手上这些图都说得通,它们就能放进一批;如果有几张怎么套都不对,那它们就该被拎出去单独处理。
七、上传之后必须做的一次清点
图传上去不代表这一步就完了。上传之后有一个三十秒的动作,强烈建议固定下来:在参考图区把缩略图从头看一遍,看三件事。
第一件,数量对不对。你以为传了五张,实际可能漏了一张,或者多传了一张。小屏上缩略图长得都差不多,凭印象很容易出错,必须用眼睛数。第二件,有没有混进不该出现的图。比如上一款产品的图还没删,或者误选了一张包装盒的照片。第三件,顺序是不是你想要的。有些时候你希望某张图被优先参照,那就确认它在位置上是靠前的。
这三件事加起来花不了半分钟,但能挡掉后面最耗时间的一类麻烦——跑到一半发现传错图,前面的等待全部作废。尤其是第一次做某个新品类的时候,多看这一眼,性价比很高。
清点完之后再往下一步走。这时候如果发现有问题,改动的成本几乎为零;一旦点了执行,改动的成本就是重新等一轮。同样一件小事,做在前面和做在后面,代价差了好几倍。
把清点的动作和整条上传链路串起来看,就是下面五步。每一步都只做一个小判断,走完就能把参考图区准备妥当。

图3:挑、传、看、点、确认,五个动作走完,参考图区就准备好了。
第一步:先把图挑出来
在本地先筛一遍,只留下主体清晰、无遮挡的商品实拍图。优先正面清晰照,一个画面里只留一个主角。
第二步:点【上传图片】选图
在参考图区点【上传图片】,从本地把挑好的图选进来,单次最多 10 张,超出的部分留到下一批。
第三步:看缩略图对不对
上传完成后扫一眼缩略图,确认张数、内容和你挑的是同一批,别把无关的图带进来。
第四步:确认主体清晰无遮挡
再按检查项过一遍:主体完整、对焦清楚、表面没被挡、光线均匀、画面里只有一个产品。
第五步:再写提示词、设参数
参考图确认无误之后,再往提示词区和参数设置走,写指令、选比例,最后点【创建任务】。
这五步的顺序不要颠倒。先图后词是有道理的:你手上的图长什么样,决定了提示词该怎么写。图还没定就先写一堆指令,很容易写完发现对不上。
还有一点:第五步提到的三块区域确认无误之后,点的是弹窗底部的【创建任务】,系统会自动计算消耗积分再执行。所以整个上传环节属于「执行之前」的准备工作,做得好不好,直接影响这一次任务的产出质量。在青虎AI 的操作弹窗里,参考图区排在最上面,也是有意为之——它本来就是整条链路的第一道关。
八、四个常见误区
下面这四种想法,是上传环节里出现频率最高的判断偏差。
误区一:图越多识别越准
不是。识别准不准取决于信息质量,不取决于数量。一张清晰的正面图,胜过三张从各个角度拍的糊图。10 张是上限,不是及格线。
误区二:手机随手的图也能用
手机能出好图,但「随手」不行。对焦、光线、背景这三样只要有一项失控,图的质量就会掉。能不能用,看的是这张图本身合不合格,不是用什么设备拍的。
误区三:一张图里放多个角度更省事
把同一个产品的几个角度拼在一张图里,AI 看到的是混乱构图,反而增加识别难度。需要多角度,就分开传,不要在一张图里拼。
误区四:同一批可以放不同的产品
同一批参考图会共用后面的提示词和参数。图里混着好几个产品,指令就很难同时对每张图都成立,容易两头不讨好。
九、四个能立刻照做的技巧
这四条都不需要额外设备,也不需要提前很久准备,看完就能用。
技巧一:拍之前先清场
把桌面或拍摄台上跟这个产品无关的东西全部挪走。图里的每个多余元素,都是 AI 可能误读的信号。清场十秒,省下的是一轮返工。
技巧二:同一款多备一张图
重拍成本很低的时候,同一个角度多拍一两张。等真要上传时挑最清楚的那一张,选择权在自己手里,比只有一张将就着用安心。
技巧三:先建一个待上传文件夹
把这次要用的图单独挑出来放进一个文件夹,上传时整批选中,不用在一堆历史素材里翻找。这个习惯能把上传动作缩短到几秒。
技巧四:小屏别做最终判断
手机或小窗口上看图会显清楚。要做取舍时,把图放大到接近实际展示尺寸再看一遍,模糊的图在这个环节就会现形。
这四条里,真正见效最快的是第一条。拍摄现场多花十秒清一遍台面,是投入最小、回报最直接的动作。很多图出来不对的问题,根子都在拍摄台上那一秒钟的随手。
十、三个可以照做的场景
抽象的原则说完,看三个具体到能直接照着做的场景。

图4:拍摄台上只留一个主体,上传环节的麻烦就少掉一大半。
场景一:单品上架,只有一张实拍图
手上只有厂家发来的一张产品图。先按前面的检查清单过一遍:主体完整、对焦清楚、无遮挡、光线均匀、主体单一。四条都过,直接上传;有任意一条不过,想办法补拍或换图,不要将就。
场景二:系列款一起处理
一个系列三款产品,每款各有一张正面图。把这三张放进同一批参考图,共用同一组提示词和同一套参数,出来的一批图风格统一。注意每张图里只出现一个产品,不要用系列的合影。
场景三:需要多个角度呈现
产品有几个面都需要展示,手上每个面都拍了。不要拼图,把每个面的照片分开作为独立的参考图上传;如果总数超过 10 张,按面或按款拆成两批,一批一批处理。
这三个场景的共同点是:它们都发生在点【创建任务】之前,却决定了后面所有环节的顺畅程度。上传这个动作本身很快,真正需要你花心思的是传哪几张——这一步想清楚了,后面的提示词和参数都只需要按默认往下走。青虎AI 的参考图区单次上限 10 张,说多不多,说少不少,正好卡在「一批图共用一套指令」这个量级上。
出图之后,建议把这一批的参考图另存一份。理由很实际:以后想重新出一版、换一种风格重做,你会需要用到同一批原材料,手边有备份就不必再回头找图。
十一、总结
总结:上传是三秒钟的动作,决定后面一整套结果
参考图区在弹窗偏上的位置,点【上传图片】从本地选商品实拍图,单次最多 10 张。挑图的标准是主体清晰、无遮挡:产品完整不出画、对焦锐利、表面没被手或道具挡住、光线均匀、画面里只有一个主角。优先用正面清晰照,斜角、模糊、多主体混放的图会让特征提取不完整,结果容易跑偏。10 张是上限不是目标,凑满没有意义,图多就按「这一批的提示词能否对每张图都成立」来拆批。上传后花三十秒清点数量、内容、顺序,这一步几乎不占时间,却能挡掉最耗时的返工。在青虎AI 的批量生图里,把这一步做扎实,后面几句提示词就越写越省心。
十二、常见问题解答
问:参考图在哪里上传?
答:在批量生图弹窗的参考图区,点【上传图片】从本地选商品实拍图,选完确认,缩略图会出现在这一区域里。
问:一次最多能上传几张?
答:单次最多上传 10 张参考图。这是上限,不是必须凑满的数量,够用就行。
问:用什么设备拍的图有关系吗?
答:设备本身不是关键,图的质量才是。手机拍摄也能出好图,但要对焦准确、光线均匀、背景干净,参数正常的图都能用。
问:为什么要求主体清晰、无遮挡?
答:因为 AI 是通过参考图认识产品的。主体清晰、没有遮挡,它识别产品造型才准确,后面按提示词变换风格时主体才不容易走形。
问:斜着拍的产品图能用吗?
答:看情况。产品正面信息已经足够时可以;如果靠侧面结构才能分辨,斜角图的信息可能不够,成品容易出现臆造的细节,建议补一张正面图。
问:产品图有点糊,还能上传吗?
答:不建议。模糊的图边缘细节会丢失,AI 抓不到准确轮廓,出的图边缘容易发糊、材质失准。有条件的话重拍一张更省事。
问:一张图里放多个产品会怎样?
答:AI 看到多个主体,会分不清你要出的是哪一个,特征可能被揉在一起,成品既不像 A 也不像 B。一个画面里只留一个主角。
问:可以把几个角度拼成一张图上传吗?
答:不建议。拼图会让画面构图变复杂,增加识别难度。需要多个角度,就分开作为独立参考图上传。
问:同一批参考图里可以放不同产品吗?
答:要谨慎。同一批图会共用后面的提示词和参数,产品太多样,一句指令很难同时对每张图都成立。按品类或按款分组更稳。
问:传完图发现选错了,能重新选吗?
答:可以。上传之后参考图还能重新调整,改完再往下走就行。所以建议上传后先清点一遍,把问题解决在执行之前。
问:上传之后还要检查什么?
答:建议看三件事:数量对不对、有没有混进不相关的图、顺序是不是你想要的。这个动作三十秒,能避免跑到一半才发现传错。
问:参考图上传后会丢失吗?
答:生成不会覆盖你本地的原图,原素材一直在你手里。仍建议把这一批参考图另存一份,方便以后重新出图或换风格重做。

评论列表 (0条):
加载更多评论 Loading...