AI 图片做出来了,为什么还要反复改?

0 阅读9分钟

第四生产力 · AI 创作实践

设想你要给一款保温杯做促销海报。产品照片已经有了,只想换个秋天的背景,再放上价格和活动日期。

第一版出来,气氛不错。仔细看,杯盖的形状变了。让 AI 改回杯盖,标题的位置又不合适。继续改标题,还得回头检查产品有没有被动过。

这是一个假设场景,用来说明改图时的麻烦。每次修改都有明确目标,可如果其他部分也发生变化,上一轮检查过的地方就要重新检查。反复几次,出图之后的工作也不少。

Qwen Image 2.1 的局部编辑、多参考图和透明素材能力,正好给这类工作提供了新的处理办法。本文依据官方说明讨论用法,尚未做独立实测,不给它的成功率下结论。

我更关心的是:用这些能力做海报时,怎样安排步骤,才能减少返工?

先说清楚,你到底想让 AI 改什么

回到这只保温杯。如果要求是“做一张高级的秋日促销海报”,模型需要同时安排产品、背景、文字和构图。

“高级”没有告诉它杯子应该占多大、哪里要留字,更没有说明杯盖形状和包装文字必须保留。结果不合适时,我们也很难判断是哪条要求没说清。

可以先把要求写具体:

用提供的保温杯照片做主体,放在秋日户外的桌面上。杯子位于画面左侧,右侧留空,后续添加活动文字。背景可以调整,产品外形、标志和杯身文字需要保留。

这是一份任务说明示例,不保证一次生成就成功。它的用处在于:拿到结果后,有明确的检查对象。产品位置不对就改位置,留白不足就调构图,不必每次都用“再好看一点”重新开始。

Qwen 官方介绍,Image 2.1 支持最多十张参考图,也支持通过圈选、涂绘或单独的蒙版指定编辑区域。蒙版就是另画一张区域图,标出要改的位置。官方发布说明

参考图多了,更需要交代每张图的用途。在这个海报里,可以指定第一张提供产品外观,第二张只参考背景色调,第三张只参考构图。否则,几份素材之间怎么取舍,仍然要留给模型猜。

能放十张图,是输入上限。具体任务需要几张,要看每张图是否提供了必要信息。我的建议是先用足够说明需求的最少素材,结果缺什么再补。

产品细节必须准确,还要让模型重新画一遍吗?

把任务写清以后,仍然有一个取舍:哪些地方交给模型生成,哪些地方直接沿用原素材?

如果只是内部讨论海报风格,可以让模型生成整张画面,先比较方向。此时背景、构图、产品摆放都可以尝试,修改空间越大,越容易找出不同方案。

但如果这张海报要展示一款确定的商品,杯盖结构、标志、容量文字都要对得上实物。让模型重新生成产品,也就增加了一项工作:逐处比对它有没有画错。

对于这类任务,我会优先保留已经确认的产品素材,让 AI 生成背景,再把产品合成进去。这样检查时,重点可以放在接触位置、大小比例、光线和阴影上。

这个办法也有代价。原照片的拍摄角度可能不适合新背景,产品放进去会显得生硬。此时要换合适的产品照片、调整背景,或继续做合成处理,不能指望保留原图就自动解决所有问题。

因此,选择取决于用途:需要快速看创意,可以放开生成;需要准确展示实物,就应尽量减少对商品本身的重新绘制。

透明背景,为什么比“又多一种画风”更实用?

保留产品素材后,下一个问题是怎么把它放进新背景。

普通照片连着原来的背景。要换场景,通常得先把产品从背景里分离出来。得到周围透明的主体图片后,才能方便地叠放在其他画面上。

Qwen Image 2.1 官方说明支持生成和编辑透明图片,也展示了从照片中提取透明主体的用法。这对海报制作的意义,是产品、背景和文字可以分开处理。官方发布说明

比如背景太暗,只改背景;价格变了,只改文字;需要另一种版式,就重新摆放产品。把需要独立修改的部分分开保存,后续就不必总拿整张图重新生成。

这里还要检查提取结果。杯子边缘是否缺了一块,提手里的背景是否残留,透明或反光部位是否自然,都要放大看。模型提取的主体也需要与原照片比对。

透明图片只表示图片能保存透明区域。它不会自动附带一份可逐层编辑的设计源文件。产品、背景、文字如何分别保存,仍要由制作过程安排。

只改一个地方,检查也只看那个地方吗?

假设背景和产品已经满意,现在只想去掉桌上的一片叶子。

可以用局部编辑标出那片叶子,说明要补成什么背景。与笼统地说“整理一下桌面”相比,修改范围和目标更明确。

但官方展示了局部编辑能力,并没有给出“选区之外始终逐像素不变”的保证。检查时,需要比较修改前后的图片,确认叶子去掉了,也确认原本满意的产品和文字没有出现需要处理的变化。

这里可以定一个很具体的习惯:每轮先保留上一版,再写清本轮只解决什么问题。

如果这一轮是去叶子,就先判断这个修改是否完成。若同时想换背景、改产品角度、换字体,最好回到版式讨论阶段;这些要求一起变化,很难继续沿用上一版的检查结果。

还要保留可退回的版本。假如新版背景更好,却把杯子改坏了,旧版能让你重新选择修改办法,而不用凭印象要求模型“改回之前那个样子”。

字已经能生成了,为什么价格还建议单独排?

Qwen 官方介绍了文字表现的改进。对招牌、装饰字和需要融入场景的文字,这类能力有直接用途。官方发布说明

促销海报上的价格和日期,还承担着另一项任务:准确告诉顾客活动条件。

如果把这些信息直接生成在整张图里,价格一调整,就要再编辑一次图片,再核对数字、字形和周围排版。将它们保留为可编辑文字,修改时就能直接替换具体内容。

所以这张保温杯海报,我会让 AI 留出文字区域,再用排版工具放入已确认的价格、日期和活动规则。生成模型负责的部分少一些,后续改价和校对会更明确。

最后检查应有固定的依据。产品细节对照原照片,价格日期对照活动表,尺寸对照发布位置。请一个人“帮忙看看”时,也把这些依据一起交给他。

运营可以检查排版,但如果他拿不到最终活动价格,再仔细也无法确认价格是否正确。活动负责人应先提供确定信息;有改动,再让制作人更新对应文字。

开始之前,还有什么会让整张图重做?

还有一类返工,发生在选素材的时候。

如果运营从网上找了一张秋景照片,准备直接拿来合成海报,就需要先确认照片的使用条件。若不允许这样使用,后面构图做得再满意,也可能需要更换素材重做。

这和模型读不读得懂照片没有关系。要解决它,就在选素材时查清来源和许可,优先使用团队已有权使用的照片。

若团队准备自行部署 Qwen Image 2.1 接入商业生产,也要先核对模型许可。当前官方仓库的研究许可证写明,商业使用相关模型材料需要申请许可。通过第三方服务使用时,还应查看该服务的条款,不能仅凭模型可下载就判断使用范围。官方许可证

这些条件查清后,再开始批量制作,可以避免把已经投入的工作推倒重来。

怎样判断这套办法有没有省时间?

做完这张海报,值得记录的是从提出需求到确认可用,总共花了多少时间。

可以拿同一类任务比较:整张反复生成,和分开处理背景、产品、文字,各自需要多少轮修改,哪些地方最常返工。这比只记录一次出图耗时,更接近日常工作的成本。

如果整张生成已经足够满足用途,就没有必要强行拆开。只有当某些部分必须准确保留、频繁修改时,分开处理才更有价值。

上一篇写文章时,我们讨论过先把观点想清楚,再让 AI 帮忙展开。做图片也需要提前做选择:哪些内容可以尝试,哪些内容已经确定,改动之后依据什么检查。

Qwen Image 2.1 提供了更丰富的编辑手段。怎么组合这些手段,需要从手里的具体任务出发。

你用 AI 做图时,最费时间的是产品变样、文字出错,还是改一处又得检查整张?留言说一个你遇到的情况就行。

—— 第四生产力 ——

关注企业级 AI 工程实践,让 AI 进入真实工作。