批量译图的操作里,真正需要动脑子的地方只有一处:翻译指令怎么写。上传、选模型、点生成,这些都是固定动作;唯独那句指令,你写什么,结果就朝什么方向走。
好消息是,这句话的门槛比很多人想得低。输入框里默认就写好了「将图片中的文字翻译为:英语」,多数情况下你要做的只是把「英语」两个字改成别的语种。不需要押韵,不需要堆形容词,更不需要写成一段话。
但门槛低不等于可以随便写。同一批图只会认一条指令,指令里说清了什么、漏掉了什么,直接决定这批成品能不能用。写得对,一批图五分钟出成品;写得含糊,你可能在核对环节多花半个小时,还把返工的原因误判成「工具不行」。
下面把「怎么写、为什么这么写、什么写法一定是错的」讲清楚。

图1:整条流程里唯一需要「想一句」的地方,就是屏幕中间那个输入框。
一、先理解这条指令在整批图里的角色
翻译指令不是给某一张图写的备注,它是给这一整批图下的同一条命令。点生成之后,AI 会统一按这条指令,同步处理所有已上传的图片。这意味着指令里的每一个字,都同时在几十张图上生效。
理解这一点,很多写法的对错就自然明了了。比如你在一批图里写了「把图片中的中文标题翻译成英语,但保留价格数字」,如果这批里有一张图没有价格,那条限定条件就落空了;如果有一张图的价格本来就不是阿拉伯数字,那它的处理方式也会和你的预期不一致。一批一条指令,指令要能罩住批内每一张。
换个角度说,指令更像是给这批发往同一个市场的图统一贴上的标签,而不是逐张下发的工单。既然是标签,它就得先在「批」这一层成立。批是怎么分的,直接决定了指令能写得多细。这也是为什么上一篇反复强调按语种分批:批分得对不对,是指令能不能发挥作用的前提。
从这个角度看,写指令其实有两半:一半是选语言,一半是分组。选语言只用改三个字,分组才是真正花心思的地方。图怎么归堆、每堆放几张、哪些图不适合和别的图混在一起,这些决定做完之后,指令反倒成了顺手填上去的一件事。
默认指令已经是标准写法
输入框里默认给的是「将图片中的文字翻译为:英语」。这句话结构完整——说清了动作(翻译图片中的文字),也说清了目标(英语)。想换语种,改「英语」这两个字即可,句子骨架不用动。
还有一层要记住:指令管的是「译成什么语言」,不是「源语言是什么」。源语言在参数区,固定是简体中文,识别原图里的中文文字。指令和目标语种是一回事,别和源语言搞在一起。
把这层角色想清楚,你就能理解为什么它默认只写一句话。工具的作者已经替你把稳定性的边界画好了:目标语言必须由你来定,因为机器猜不到你要发往哪个市场;而字体、排版、主体这些「不该变的东西」,机器比人更清楚该怎么不动。两者分工明确,你只负责前者。
二、一条好指令要说清的两件事
口诀可以记成八个字:译成什么,保留什么。前半句是目标语言,后半句是你要 AI 别乱动的东西。默认那句「将图片中的文字翻译为:英语」把前半句说满了,后半句其实由工具的机制兜底——自动匹配原图字体、排版、光影,完整保留产品主体与构图。
也就是说,多数时候你连后半句都不用写,工具默认就会保留主体。但知道「保留什么」这半句存在,对你判断某些特殊情况很有用:当你发现结果把某样东西改动了,回头想清楚是不是指令里的限定条件不够,就能对症调整。

图2:左边是堆满限定的长指令,右边是改一个语言名的短指令,后者更容易整批通用。
| 指令要素 | 默认那句里对应什么 | 需不需要自己写 | 写与不写的差别 |
|---|---|---|---|
| 译成什么语言 | 「翻译为:英语」 | 必须写清,换语种改这里 | 决定成品是英文还是日语等 |
| 译哪些内容 | 「图片中的文字」 | 默认已覆盖画面内文字 | 一般不用加限定 |
| 保留什么 | 默认机制已保留主体与构图 | 一般不用写 | 特殊图可点明要保留的元素 |
这张表的核心信息是:你真正需要动手的只有第一行。后面两行是默认兜底,了解即可。别把简单的事写复杂,那反而是失误的来源。很多人第一次写指令时把三行全写了,结果既没提高质量,还因为限定太多让部分图无法被正确覆盖。
把这张表和默认那句对着看,会发现一个有意思的事实:默认值本身就是「最优写法」。工具把最容易出错的地方替你定了,你要做的只是在一个变量上做选择。理解了这一点,写指令这件事的焦虑感基本就没了。
三、几种能直接抄的指令写法
把常用语种过一遍,写法如下,照着改就行。
译成英语
将图片中的文字翻译为:英语。这是默认写法,跨境英语站的通用选择。
译成日语
将图片中的文字翻译为:日语。句式不动,只换语言名,适配日本站点。
译成韩语
将图片中的文字翻译为:韩语。文档里有原图翻韩语的成对示例可参照。
译成西班牙语或俄语
将图片中的文字翻译为:西班牙语(或俄语)。同一处语言名替换即可,一条指令一个目标语种。
可以看到,四种写法除了语言名不同,其余完全一致。这就是这个功能设计得聪明的地方:把「目标语种」收成指令里的一个变量,而不是新增一堆开关。你要学的只有一句模板,语种换一换就覆盖了英语、日语、韩语、西班牙语、俄语等目标市场。
四种写法里,英语是默认值,也是用得最多的一种。原因不复杂:英语站的市场体量在那,多数店铺出海第一站就是英语。日语和韩语的写法规则相同,只是面向的市场不同;西班牙语和俄语覆盖的是另一些区域市场,字符形态差异更大,排版上需要多留意。
用一个具体例子把差异说清楚。同一张中文主图,译成英语时文字块通常向右延展、行数可能变多;译成日语时字符紧凑、占位可能反而缩小;译成俄语这类字符高度较大的语言,行距压力会更明显。这几种情况都不需要你在指令里处理,但知道它们存在,核对的时候就知道该重点看哪个方向。
如果你要同时铺英语、日语、西班牙语三个站点,正确做法不是写三条指令一次性提交,而是分三批:先传英语批跑完下载,再传日语批,再跑西班牙语批。每批的一条指令都保持最简,语种切换只发生在语言名这三个字上。这样做的代价是多点两次,换来的是每一批结果都可控、可追溯。
注意一个细节:一批里只写一条指令,也只对应一个目标语种。不要在一句话里堆砌「翻译为英语和日语」,那样做出来的结果不可控,工具也没有对应的参数去承接。要多个语种,就按语种分批,一批一条指令。
四、为什么不用堆复杂描述
很多人刚接触这类工具时,习惯把指令写成一段长句,比如「请把图片里的中文标题、卖点、价格全部翻译成地道的英语,保持原来的字体和位置,不要改动产品本身,风格要专业」。这种写法看着周到,实际上有两个问题。
第一个问题是前面说的:一批一条指令,描述越细,覆盖不到所有图的风险越大。这批里有五张图没有价格,你写了「价格全部翻译」,那五张就白搭了。第二个问题是,字体、排版、光影匹配、主体保留这些事,工具是默认机制在处理,不需要你在指令里重复交代。你写上去,也改变不了机制,只是让句子变长。
简洁是为了批内一致
指令越短,越容易被批里每一张图满足。默认那句之所以是标准写法,就是因为它在「说清目标」和「不设多余条件」之间取了一个平衡点。多数场景下直接用默认、改语言名,就是最稳的做法。
只有一种情况值得加限定:这批图里有某种你特别不希望被碰的元素,而这种元素在批内普遍存在。比如整批图都带同一个活动角标,你想确保它不被重新生成。但即便如此,也要先判断这个元素是不是图内文字——如果它本身是中文文字,那它就是待翻译对象,加限定反而自相矛盾。
换句话说,加限定的场景非常少,绝大多数时候「不加」才是正确选择。这不是偷懒,是尊重工具的默认能力。青虎AI 把匹配字体、贴合排版、保留光影这些事做进了默认机制里,就是想让你的指令保持轻盈。你越少干预,它的一致性越稳。
也可以反过来验证这个判断。假设你把限定写得非常细,结果某张图没被正确处理,你很难判断到底是「指令没说清」还是「图本身难度高」。而用默认写法,出问题时判断路径就简单得多:语言名对的,那问题十有八九在图,不在指令。写法简洁带来的不只是稳定性,还有排查的便利。
换句话说,加限定的场景非常少,绝大多数时候「不加」才是正确选择。这不是偷懒,是尊重工具的默认能力。
五、指令和参数区怎么配合
指令不是孤立存在的,它要和参数区一起看。两者分工清楚,才不会互相打架。
| 你要的结果 | 翻译指令怎么写 | 参数区怎么设 | 容易出错的组合 |
|---|---|---|---|
| 一批图统一译成英语 | 将图片中的文字翻译为:英语 | 生成模型保持图片 5.0 Lite,源语言简体中文,数量 1 | 把英语写进源语言栏 |
| 换一批译成日语 | 将图片中的文字翻译为:日语 | 同上,另起一批处理 | 与英语图混在同一批 |
| 想保留原图构图 | 维持默认句不改 | 常用场景/模特不选 | 误以为不选场景效果差 |
| 想多要几版挑选 | 维持默认句不改 | 数量从 1 调大 | 拿数量当语种开关用 |
四行里最值得记住的是第一行和第三行。目标语种永远写在指令里,源语言永远不动;要保原构图就别选场景。把这两条钉住,参数区和指令之间基本不会再打架。剩下的两行是执行层的小调整,理解原理之后按需处理就行。
从使用顺序看,建议先写指令、再核参数。因为指令是这一批的「主题」,参数是围绕主题的「配置」。主题先定,配置才有意义。反过来先调参数再想指令,容易出现「参数调得很细,但指令没写对语种」这种本末倒置的情况。
数量这一项要单独提一句。它控制的是单批次生成数量,默认 1。把它调大能得到同一张图的多个版本,但不会改变语种,也不会改变构图逻辑。用数量去试语种是常见误解,语种只认指令里的那个语言名。
再往下想一层,指令和参数区的分工其实反映了一个更普遍的原则:能由机制兜底的,就别写进指令。这样做的直接好处是,你的指令永远只表达「意图」,不背负「执行细节」。意图简单,覆盖范围就广;执行细节交给机制,稳定性反而更高。青虎AI 把批量译图的指令设计成一句话,正是这个思路的体现。
六、写指令到出图,六个动作按顺序走
下面把写指令这件事放回完整流程里看一遍。重点在步骤三,但前后步骤也不能跳。

图3:中间那个输入框是分水岭,前面是准备,后面是执行。
步骤一:上传参考图
进入批量译图弹窗后,原图区批量选中本地商品图,单次最多 10 张,超出就分批。
步骤二:按语种确认这一批
先看这批图是不是同一个目标语种。混语种的图先挑出来,单独成批。
步骤三:写翻译指令
在批量设置的输入框里确认或修改指令。默认是「将图片中的文字翻译为:英语」,换语种就改语言名。
步骤四:核对参数区四项
生成模型默认图片 5.0 Lite;源语言固定简体中文;数量默认 1;常用场景/模特不选则保持原图构图。
步骤五:点生成
AI 按这条指令同步批量修改所有已上传图片,保留产品、背景、版式,替换画面内全部中文。
步骤六:批量下载并核对
完成后批量下载成品图。文字密集、字体特殊、倾斜排版的图建议人工核对一遍。
六个动作里,步骤三只要十秒钟,步骤四只要五秒钟,但它们决定后面全部结果。前面两步是准备,后面两步是收尾。把中间两秒的决策做对,整批的返工率会明显下降。这也是为什么标题问的是「指令怎么写」,而答案其实有一半在步骤二——批分对了,指令才写得对。
对这个流程熟悉之后,你会发现它更像一条固定的生产线:进料(传图)、设参数(指令)、加工(生成)、质检(核对)、入库(下载)。写成「指令」的那个环节看起来最小,却决定了整条线的产出形态。把注意力放在这里,是投入产出比最高的地方。
七、什么情况下要回头改指令
生成完发现不对劲,先判断是不是指令的问题,还是图本身的问题。下面这张排查表按优先级排,从上往下查最快。
| 现象 | 可能原因 | 怎么处理 |
|---|---|---|
| 整批语种都不对 | 指令里的语言名没改,或改错 | 改指令语言名,重新生成 |
| 只有部分图语种不对 | 这批混了多个语种 | 拆批,按语种各跑一次 |
| 文字被替换但排版挤 | 外文相较中文膨胀 1.5 到 2 倍占位 | 原图文字太满,重排后再译 |
| 个别图有漏字或偏差 | 字体特殊、倾斜、压在复杂图案上 | 单独挑出人工核对并补处理 |
这张表的用法是「先排全局,再排局部」。整批都不对,基本是指令或批次分组的问题;只有个别图不对,多半是那张图本身难度高。搞清楚这个分界,你改起来就不会盲目,也不会因为一张图的问题把整批都重跑一遍。
还有一个不属于指令问题的现象值得说清:如果某些图译完后主体有轻微变化,先别急着改指令,先确认产品图区有没有放对参考图。主体保真这件事,一部分靠默认机制,一部分靠你给的参照够不够清楚。指令能解决的只有语言这一层的问题,把语言之外的问题都归给指令,只会越改越乱。
八、四个关于指令的误区
下面四条是写指令时最常见的心结,逐个拆掉。
误区一:指令写得越长越专业
长度不等于效果。默认那句已经把动作和目标说清了,反而更容易满足批内每一张图。堆形容词只会增加覆盖不到的风险。
误区二:一批里可以同时译多个语种
一批只认一条指令,一条指令只对应一个目标语种。要英语和日语,就分两批,别指望一句话两端通吃。
误区三:在指令里交代字体和排版
字体匹配、排版贴合、光影保留是工具的默认机制,会自动匹配原图,不需要你在指令里重复。写了也不改变机制。
误区四:把目标语种填进源语言
源语言固定简体中文,识别的是原图里的中文。目标语种写在指令里。两栏分工不同,填错位置结果就不对。
九、四个让指令更好用的技巧
技巧一:把模板存成一句话
记「将图片中的文字翻译为:X」,X 换成英语、日语、韩语、西班牙语、俄语。一句话模板覆盖所有目标市场。
技巧二:改之前先看默认
输入框默认就是可用状态,先确认它现在写的是什么,再决定改不改。很多人压根没注意默认值,白白多写了一段。
技巧三:先跑两张验证语种
第一次用某个语种,先拿两张图跑一遍看输出,确认语种和排版都对,再放整批进去。
技巧四:按批次记录指令
每批用的是哪个语种,简单记一笔。后面复盘哪批图是什么语言版本时,不用靠猜。
技巧一和技巧四其实是一对:前一个让写法标准化,后一个让记录可追溯。四个技巧都不需要额外工具,也不需要改工作习惯,只是在动手前多花几秒钟想一下。真正的差距,往往就藏在这几秒里。
十、三个实际场景里指令长什么样
抽象讲完,看三个具体场景下指令是怎么落地的。

图4:一句指令跑完整批之后,真正花时间的还是逐张核对这一步。
场景一:英语站主图出海
指令就是默认那句,一字不改。国内平台主图批量转成英文,统一替换画面里的中文标语、卖点、价格文字。
场景二:多语言铺货
同一套原图分批跑,每批改一次语言名:英语一批、日语一批、西班牙语一批。青虎AI 的批量译图按同一条指令同步处理批内全部图片,一批只服务一个语种。
场景三:促销海报换语言
带活动标签和折扣文案的海报,指令默认不改,保留原有活动角标和版式,仅替换文字内容,活动节奏不用为改字让路。
三个场景的共同点是:指令一句话,剩下的交给工具。真正需要运营判断的,是在开工前把语种分好堆,而不是在指令里堆细节。这也是批量译图这类工具的使用哲学——把复杂度放在分类上,不放在描述上。青虎AI 把这个哲学做进了默认值里,你顺着它走,就顺。
如果一定要给写指令这件事一句总结,那就是「少即是多」。写一句能被批内每张图满足的话,比写一段面面俱到却处处落空的话有用得多。语言名换对了,这一批就成了一半。
十一、总结
总结:一句模板,只换语言名
翻译指令的写法和它看起来的一样简单:默认「将图片中的文字翻译为:英语」就是标准句式,换语种只改语言名,句子骨架不动。一条指令对应一个目标语种,所以一批只放一个语种;字体、排版、光影匹配和主体保留是工具默认机制,不需要在指令里交代;源语言固定简体中文,目标语种才写在指令里。把「译成什么语言」说清、把多余的限定去掉,青虎AI 的批量译图就能给出稳定性最高的一批成品。这句模板记住之后,英语、日语、韩语、西班牙语、俄语的版本你都能自己写出来。
十二、常见问题解答
问:翻译指令的默认内容是什么?
答:默认是「将图片中的文字翻译为:英语」。这是一个已经写好的完整句式。
问:想译成日语怎么改?
答:把指令里的「英语」改成「日语」,其余部分不动。句子结构保持原样即可。
问:能译成哪些语言?
答:可改成日语、韩语、西班牙语、俄语等。文档里就有原图翻译俄语、原图翻译韩语的成对示例。
问:一句指令能同时译两种语言吗?
答:不建议。一批只认一条指令,一条指令对应一个目标语种。要多个语种就分批跑。
问:需要在指令里说明保留原图吗?
答:一般不用。工具会自动匹配原图字体、排版和光影,完整保留产品主体与构图,这是默认能力。
问:能指定只翻译标题不翻译价格吗?
答:不建议加这类限定。一批里各图文字构成不同,限定条件容易只对部分图成立。除非批内普遍存在同类元素,否则保持默认更稳。
问:指令写长一点效果会更好吗?
答:不会。指令越长,覆盖不到批内所有图的风险越大。简洁的默认句式反而是稳定性最高的写法。
问:源语言和目标语种是什么关系?
答:源语言固定是简体中文,负责识别原图里的中文;目标语种写在翻译指令里,决定译成哪种语言。两者不在同一处设置。
问:改错语种了怎么办?
答:改回指令里的语言名重新生成即可。生成不覆盖原图,原图还在,参数可以重新设置再跑一遍。
问:数量调大能多出几种语言吗?
答:不能。数量控制的是单批次生成数量,不改变目标语种。要换语言,只能改翻译指令。
问:指令写好之后还要改参数吗?
答:多数情况不用。生成模型默认图片 5.0 Lite,源语言固定简体中文,数量默认 1,常用场景/模特不选则保持原图构图。
问:同一批图可以用不同指令吗?
答:一批跑一次,一次一条指令。需要不同指令的图,拆成不同的批,各自上传后分别生成。
问:译完发现排版挤是什么原因?
答:多数是因为外文相较中文膨胀 1.5 到 2 倍占位,原图中文排得太满。这类图建议先重排原图文字再译。
问:哪些图译完要人工核对?
答:文字密集、字体特殊、倾斜排版的图片,建议译图后人工核对一遍,把漏字和挤压挑出来。

评论列表 (0条):
加载更多评论 Loading...