GPT Image 2 多角度商品图对不上:一致性的 6 个维度,哪 2 个该直接转后期
做品牌视觉的人对”一致性”有一种近乎生理性的敏感。品牌手册里主色差一档就是事故,logo 的安全边距少两个像素也得打回重做(不是矫情——品牌资产的价值本来就建立在”每一次出现都长一样”上面)。所以第一次拿 AI 给同一件商品出多角度图、发现并排的几张像几件不同的商品时,那种不适感来得特别快。
先把问题摆成几个具体的疑问,后面逐个回答:
- 同一件商品出正面、45 度、侧面、俯视四张图,为什么其中一张的瓶盖突然矮了一截?
- 色号已经写进 prompt 了,出来的图为什么还是差一档?
- 参考图能把材质传过去,那它能不能顺手把 logo 的位置也带过去?
- 网上的教程都在讲”固定 seed”,可我在图叮的生图页面上根本找不到那个输入框,是我瞎了吗?
- 什么时候该停止调 prompt,直接把图丢进 Photoshop?
结论先给:一致性不是一个能打开的开关,它是六个彼此独立的维度,每个维度的可锁性天差地别——其中两个(截至 2026-07)大概率锁不住。认清哪两个锁不住,比再调二十轮 prompt 有用。
模型不记得上一张图,这不是 bug 是采样机制
先把最容易被误解的一点讲清楚:它不是”忘了”,它是从来没记过。
每一次生成都是从一团随机噪声开始的独立采样。你点第二次”生成”的时候,模型手里并没有一个叫”这件商品”的对象——它只有你这次给的 prompt 和参考图。所谓”同一件商品”,是你脑子里的概念,不是模型状态里的实体。它没有三维模型可以调用,没有物料清单可以对照,也没有”上一张我把把手画成什么弧度”的记录。
商用模型的内部机制并没有完整公开,上面这段是一种可能的解释。但有一件事你自己就能验证:同一句 prompt 连点两次生成,出来的是两张不一样的图——这本身就说明它没有跨请求的持久状态。
所以指望模型自己记住是不现实的。一致性只能从外部锁进去——你给它多少约束,它还你多少一致;剩下的部分,它一定会用”看起来合理的猜测”补满。这是理解后面所有招数的前提:你不是在提醒模型,你是在给它加约束。
图注:同一句 prompt 抽六次,没有两只是同一个瓶子
把一致性拆成六个维度:先分清哪一格在闹
我在项目里养成的习惯,是不再说”这组图不一致”,而是先问”哪个维度不一致”。因为这六个维度的成因和归属完全不同,混在一起谈就只能得到”多传几张参考图”这种没用的建议。
| 维度 | 它具体指什么 | 归谁管 |
|---|---|---|
| 视角关系 | 几张图之间的角度间隔是否成体系 | 完全归你——这是拍摄脚本,不是模型的活 |
| 光照方向 | 主光来向、高光落点、投影朝向 | 归 prompt + 参考图,压得住 |
| 主体形状 | 轮廓、比例、把手弧度、瓶身收腰 | 半归模型:角度跨得越大越松 |
| 材质纹理 | 釉面 / 磨砂 / 拉丝的疏密与走向 | 类别传得过去,密度传不过去 |
| 颜色 | 主色的绝对值、饱和度、色温倾向 | 别指望——归后期 |
| logo 与文字位置 | 标识在瓶身的相对坐标、印刷字的笔画 | 别指望——归后期 |
这张表我故意不写百分比。可锁性会随模型版本翻篇,写死一个数字,半年后它只会变成误导;而”这一格归谁管”是由维度本身的性质决定的,不会那么快过期。
顺便和站内那篇实验划一下界。图叮站内 2026 年 4 月发过一篇9 张图批处理一致性实验,它是按手段组织的——seed、参考图、锁色分别能稳住什么。本篇是按维度组织的——哪些维度锁得住、哪些锁不住、什么时候该放弃。两条轴正交,对着看更完整。但那篇实验没有附上原始图和可复现的任务记录,所以它给出的具体数字,我在这篇里一个都不引用,你也别拿去当汇报基准。
能锁的那四格:锁法不同,而且不一定在你手里
视角关系这一格,根本不是模型的锅。 几张图的角度间隔该怎么排(正面 / 45 度 / 侧面 / 俯视 / 细节),这是拍摄脚本层面的事,得你先想清楚再开工。很多”看着就是不对”的观感,根子是这几张图压根没有一套角度体系,各是各的。这一格的解法是拿张纸把角度序列写下来,跟模型没关系。
光照方向是四格里最好压的。 因为光照是一个氛围性属性,而氛围恰好是这类模型最擅长复现的东西。prompt 里把主光方向、光质、投影朝向写死(“左上方大面积柔光,投影落在右下,无硬边”),再配一张光照对味的参考图,基本能收住。
主体形状的可锁性有角度依赖。 小步长的角度序列(正面 → 45 度 → 侧面)是模型的舒适区:新视角能从旧视角的信息里推出来。一旦跨到背面、仰视这种”旧视角里根本看不见”的区域,模型只能重新编——它不是在复现你的商品,是在重新想象一遍。所以脚本上就该做减法:跨度大的角度宁可少出,别指望它接得上。
材质传得过去的是”什么材质”,传不过去的是”纹理多密”。 参考图能让模型知道这是拉丝金属,但拉丝的方向和条纹间距会在每张图里重新掷一次骰子。细节特写尤其危险:镜头一推近,模型会自动补它认为该有的纹理密度,那个密度和主图对不上。
这里必须说一句实话,免得你照着教程去找不存在的按钮。 截至 2026-07,图叮网页端的 Image-2 生图页给你的控制项只有三样:prompt、画面比例、参考图。没有 seed 输入框,没有图像权重滑块,也没有”锁色”开关。所以”把 seed 固定下来”这类建议,在这里是执行不了的——不是你没找到,是它没有。
如果你用的是另一类工具(一些开源工作流和桌面端会把这些控件暴露出来),那也得先弄清它们各自的作用范围,别神化:
- 固定 seed 锁的是”从哪团噪声开始”。它带来的一致性是整体色调和大致光影倾向,不是形态。把它当”降低随机性的底噪控制”是对的,当”锁定商品”是错的。
- 图像权重(参考图的影响力)不是越高越好。调得过头,模型会把正面图的形态硬搬到别的视角上,出来的是扭曲而不是一致。合适的值只能你在自己的工具上试出来——它和模型版本、参考图质量都有关,抄别人的数字没有意义。
- 锁色能锁颜色的绝对值,锁不了它在不同光照下的呈现。这一条下一节展开。
参考图怎么挑、几张、什么角度组合,站内那篇5 张参考图怎么用才不乱已经讲透了输入侧的组合逻辑。这里只补一条本文视角的判断:为多角度一致性挑参考图时,别挑”最好看的那张”,挑”信息量最完整的那张”——把手、logo、材质三样东西能在这一张里同时看清,比构图漂亮重要得多。
锁不住的那两格:颜色和 logo,以及停手的信号
表里可锁性最低的两格——颜色和 logo/文字——得单独说。它们是最常被死磕、也最不该被死磕的两项。
颜色为什么锁不住:你要的和它给的不在一个精度层级上。 你要的是色号,一个可测量的绝对值;模型输出的是色感,一种统计意义上的倾向。它能稳定地给你”偏冷的白”,给不了”就是这个白”。更麻烦的是,就算色值真对上了,颜色的呈现还得过光照这一关:仰视图受光少、整体发暗,色值没错,视觉上就是和正面图不像一件东西。这不是漂移,这是成像——模型没做错,可你的九宫格还是不能用。
logo 和文字为什么更没戏:它生成的是一片看起来像标识的像素,而不是把一个图形贴上去。 角度一变,它得重新推断这个图形在新透视下该长什么样,于是笔画糊化、位置偏移、字重变化几乎同时发生。站内那篇出图 5 大常见问题修复把 logo 丢失和商品变形单列成两类高频翻车,讲的是同一件事。
图注:同一个标识,两次抽出来是两个东西
那”该停手”的信号是什么?我用四条,全都是你自己就能判定的现象,不需要任何统计:
信号一:同一处问题重生成两次仍然不对。 判据是”仍然不对”,不是”好了一点”。从第三次开始你就是在赌骰子,而骰子的期望值不会因为你多摇几次变好。
信号二:问题落在可测量的绝对值上。 色号、坐标、字形——这类问题调 prompt,是在用统计手段解一个确定性问题。反过来,氛围类的问题(太冷了、太干净了、光太硬)值得继续调,因为氛围本来就是模型的主场。
信号三:你在改 prompt 的措辞,而不是在改它的约束。 把”保持颜色一致”改成”严格保持颜色一致”、再改成”颜色必须与参考图完全一致”——这三轮之间没有任何新增信息,纯粹是自我安慰。真正的约束长这样:“瓶身与瓶盖高度比 3:1;logo 位于正面中轴线、距瓶底三分之一高度处;表面无纹理。“能被检验的才配叫约束。
信号四:问题在缩略图上看不见,放大才看得见。 logo 边缘糊了半圈、两张图的白差了一档——这类毛病后期几分钟修得干净,prompt 十轮也未必碰得到。判断标准很朴素:如果这个毛病要把两张图并排放大到 100% 才指得出来,那它本来就该由后期解决。
停手之后干什么:让 AI 出基底,后期做统一。
颜色统一这件事,靠的是核对,不是记忆。把出好的几张图拖进图叮取色器,在每张图的同一个位置(比如瓶身正中、瓶盖顶面)各点一下,把几个 HEX 排成一列比一比,差在哪一档、差多少,一眼就看得出来。这个取色器是纯前端工具,图片在你自己的浏览器里处理、不上传服务器、注册之后不限次数、也不花钱——核对色号这种要反复跑的活,拿它最顺手。拿到色差之后再进 Photoshop 做一次统一校色,比重生成十轮划算得多。
图注:颜色靠色板和实物核对,不靠记忆
logo 和印刷文字,正确的做法从一开始就该是”让 AI 留白,后期贴回”:在 prompt 里写清 logo 位置留白、表面不出现任何字符,出图之后把矢量 logo 按透视贴回去。站内那篇 AI 出基底、PS 接管细节的接力流程把这条路径讲得比较细。如果你只是想把 AI 出的基底快速做成能上架的商品图,图叮的商品图精修可以接上——注意口径:那是 Photoshop 插件里的 AI 功能,归会员套餐管,注册送 50 张试用、订阅之后无限生成,和上面那个纯前端取色器不是一回事。
回头看开头那几个问题
为什么其中一张的瓶盖突然矮了一截? 因为主体形状这一格只在小角度区间里稳。那张大概率跨到了旧视角看不见的区域,模型在那儿是重新想象了一遍这只瓶子,不是在复现它。
色号写进 prompt 了为什么还差一档? 因为你要的是绝对值,它给的是倾向,两者不在同一个精度层级上;何况就算色值对了,还有光照那一道关。
参考图能不能顺手把 logo 位置带过去? 不能。参考图传得动的是氛围性特征(颜色倾向、光影、材质类别),logo 位置是结构性信息,它传不动。
找不到 seed 输入框是不是我瞎了? 不是。截至 2026-07,图叮网页端的 Image-2 就是只给 prompt、比例、参考图三样。教程里那些 seed 玩法,大多来自把这些控件暴露出来的开源工作流。
什么时候该丢进 Photoshop? 四个信号命中任意一个:重生成两次仍不对、问题落在可测量的绝对值上、你在改措辞而不是改约束、问题得放大到 100% 才看得见。
把这六格记在脑子里,多角度出图就从”玄学调参”变成了一张分工表:视角和光照你自己管;形状和材质交给参考图,并且认命——角度跨度越大越松;颜色和 logo 从一开始就规划给后期。真正省时间的从来不是把 prompt 调到最优,而是知道哪几格根本不该在 prompt 里解决。
读完,顺手做掉
图叮AI 的 Photoshop 插件需要免费安装,并在 PS 内使用;注册送 50 张试用,用完走会员套餐。
Image-2 生图和 Nano Banana 改图都在网页里使用;两边积分包不通用,各自按张扣积分,注册不送试用张数。
相关文章
跨境电商主图怎么做:用 AI 生图配合本土化思路卖全球
跨境电商主图怎么兼顾点击率和本土化审美?本文讲清欧美与东南亚的审美差异、用 AI 生图做场景主图的流程,以及多语言文案排版的正确做法,帮跨境卖家高效产出合规主图。
免打孔毛巾架商品图怎么拆:胶贴边缘、承重孔和铝材拉丝别被 AI 修假
免打孔毛巾架商品图不能只修得干净。本文按胶贴边缘、承重孔、铝材拉丝、墙面接触四个区域拆图,给出图叮 AI 修图前后的检查顺序。
美妆博主怎么高效做产品对比图?一键抠图加排版实战
口红试色、粉底遮瑕、眼影上眼——产品对比图是美妆内容的核心素材。本文拆解从拍摄、抠图到排版的高效工作流,帮美妆博主把繁琐的修图时间省下来。
AI 模型版本切换迁移 SOP:旧 prompt 适配新模型的 6 步检查
新模型一上线,老 prompt 第二天就失灵。本文按能力对照、prompt 兼容测试、参数翻译、风格关键词映射、批量回归、客户告知 6 步,给图叮AI 工作室一份 1-2 天可跑完的迁移清单。
推荐阅读
6 类阴影重建方案对比:AI 补光、重投影、手工绘制在鞋包与家居场景里的真实差距
白底抠图后阴影丢失、换背景后光向不对、家居商品需要环境光融合——本文对比 AI 补光 prompt、重投影算法、软阴影滤镜、手工绘制、多图合成、三维渲染 6 类方案,从方向控制精度到上手门槛逐维打分,并以鞋包与家居两类场景验证真实差距。
相框无痕挂钩图被退回:钉尖、承重标和数量包先别修没
相框无痕挂钩套装图不能只修成干净白底。本文从一次退回复盘切入,拆清钉尖、承重标、背胶片、挂片孔位和数量包该怎么保真。
化妆品套装礼盒怎么修产品图?多件混装、瓶罐反光和排版这几个常见问题的处理法
卖化妆品套装礼盒,产品图常遇多件混装光不齐、瓶瓶罐罐反光乱、外盒烫金糊、成分和净含量小字看不清。这篇按常见问题讲图叮AI修化妆品套装礼盒的做法,用一键抠图、材质高清修复、产品溶图打光把套装修干净,件数净含量以实物为准,效果以图叮官网为准。
香蕉模型能干什么:能力边界与不适用场景
香蕉(Nano Banana)到底适合改什么、改不动什么?这篇不堆功能清单,而是给一个方便判断的工作假设,顺着它看清它擅长的三件事、容易飘的三类情况,再收成一条能自己套用的判断思路,帮你在动手前就掂量出值不值得让它上。
更多推荐(8 篇)
AI一键换脸:人像面部替换的自然融合技巧
图叮AI换脸功能实操,上传面部参考图和人像底图即可完成换脸,融合自然不违和,适用于证件照和风格照制作。
微商朋友圈九宫格批量改尺寸:一键适配不被裁切的实操指南
微商发朋友圈九宫格总被系统裁掉边角?本文讲清微信朋友圈图片的尺寸规则、1比1正方形的由来,以及批量改尺寸压缩的通用方法,帮你高效产出排版整齐的产品九宫格。
给代餐粉运营的一封信:量勺、封膜和营养表别修成售后问题
代餐粉商品图不能只追求罐身干净。量勺、罐口封膜、营养成分表和冲调比例,都会影响运营解释、客服举证和买家信任,修图前要先锁证据区。
纸尿裤拉拉裤怎么修:软包装反光发灰救成白底主图的完整步骤
拉拉裤主图拍出来包装发灰、塑料膜反光、印刷字被高光压糊?这篇按顺序讲清楚用图叮做一键抠图、材质高清修复和图像扩展,把软包装商品修成能直接上架的干净白底主图,同时守住母婴合规信息不夸大的底线。
折叠桌椅产品图怎么修:卖家搜得最多的几个问题答一遍
卖折叠桌、露营椅的卖家常搜怎么修图:铝合金腿反光乱、桌面拍歪、收纳后展开状态两张图对不上。本文按搜索词聚类,用图叮的一键抠图、材质高清修复、图像扩展挨个答,讲清修图只做呈现、承重规格不能靠图夸大。
珠宝微距细节增强实战:放大后的品质感打造
面向珠宝修图师,解决珠宝拍摄后微距细节不够清晰的问题,含工艺细节增强策略和放大后的质量把控。
鞋垫商品图交付前的 6 个检查位:足弓弧度、尺码线和防滑纹要先看
鞋垫图不是修得越白越好。交付前要先检查足弓弧度、尺码线、透气孔、厚度层次和底面防滑纹,避免买家看不懂支撑感、尺码和材质。
毕业合影太糊怎么修?用图叮AI 把模糊照片变清晰的实操指南
毕业合影模糊不清怎么办?本文讲清照片变糊的几种成因、AI 修复能做什么不能做什么,并给出一套用图叮AI 把模糊毕业照变清晰的操作步骤与合理预期,帮你尽量找回当年的笑脸。