跳转到主内容
·

AI 生图手部和肢体崩坏怎么修:先分清坏的是数量、姿态、透视还是粘连,再决定重生成还是切 PS

一张刚生出来的图摊在屏幕上:光线、构图都对,模特握着冰美式的那只手不对——四根手指绕着杯壁,还有一根从杯子后面探出来,像是从杯壁里长出来的。放大到 1:1 像素视图,这只手没救。

左图红框标出待检的手,右图放大后手指结构不成立 图注:先把手放大到 1:1 看

接下来的半分钟决定你要花掉多少积分:再抽一张?框住手局部重绘?还是打开 Photoshop 手工修?

这篇不给你通过率表。截至 2026 年 7 月,任何人报出来的手部成功率都绑死在他自己的模型版本、题材和描述词上,换到你的图上并不成立;末一问会讲怎么给自己测一个。先讲更耐用的东西:手为什么坏,每一种坏法缺的是哪一类信息——路径是从这里推出来的,不是从谁的百分比里挑的。

Q:为什么 AI 生图里最容易坏的偏偏是手?

因为手是扩散模型的结构性弱点,不是你运气差。三件事叠在一起:一是姿态空间极大,手部姿态估计常用的 MediaPipe Hands 从单张图里预测 21 个手部关键点(官方文档口径),这些关键点能摆出的组合多到没边,同一只手张开、握拳、绕着杯壁,在像素上几乎是三个不同的物体;二是自遮挡严重,画面里看见三根手指,可能是被挡掉了两根,也可能真的只拍到三根;三是面积小,半身构图里手占不了多少画面,模型分给它的注意力远不如脸。而模型学的是像素分布的统计规律,它并没有手有五根手指这条显式约束——画出六根的时候,它不觉得自己错了。

顺手澄清一个被抄来抄去的说法:21 个关键点是 MediaPipe Hands 的官方口径,网上常跟在后面写的那个自由度数字并不是它说的。定性的那一半才是重点:关节多、姿势多,而这些姿势在训练数据里分布得极不均匀——照片里的手几乎从不是主角,是边角料,小、糊、被裁掉一半。

分辨率会把这件事放大:低分辨率下糊过去的走形,升到 2K、4K 全摊开。站内那篇GPT Image 2 高清出图的 5 类翻车把手部走形归在第一类(细节失真)里——高清没让手变好,只是让它藏不住。

Q:手坏了,第一件事该判断什么?

先别选工具,先给坏法分类。肉眼就能分:手指数得清、数目却不对(六根、四根、多一节指节),是数量错;数目对、关节却弯向人做不出来的方向,手腕朝内反折,是姿态错;手本身像手,可它接不上小臂,手掌朝向和胳膊拧着,是整只手的透视错;手和杯子、头发、袖口之间找不出一条边界,糊成一团,是粘连。四类缺的信息不一样,能把它补回去的路径也不一样。修图不是再试一次,是把模型缺的那条信息喂给它。

四类之前还有一问,很多人跳过:这只手在成片里到底看不看得见。

不用估比例,也不需要谁给你一个阈值——把图缩到最终要发布的尺寸(电商主图那个宽度、手机上看的那个宽度),再看一眼瑕疵还在不在。站内4 种手指与碎发难题分流法把这条单列成一种策略:评估后不修。修图的终点不是消灭所有能看见的东西,是让成片在它真正被观看的尺寸上站得住。

Q:手指数量错,局部重绘管用吗?

要看你有没有改变模型能拿到的信息。同一张图、同一个选框、同一句描述词再跑一遍,不管用。站内那篇分流法把多指少指归进 AI 的系统性失败区,主张一两遍不过就切 PS,这篇不推翻它:局部重绘不是从骨架重新推理,它是在既有的像素上下文上再采样一次,你不给它新的约束,它就没有理由这一遍突然长对。

那什么叫改变了模型能拿到的信息?三件事。

选区要完整盖住那根多余的手指。半盖等于告诉模型:框外那截留着——它于是老实地把指尖续上。站内局部重绘教程里那条选区必须覆盖目标全部像素,在手上是硬要求。

描述词只写手,正面写数量和朝向:五根手指清晰可数、拇指与其余四指分开、手背朝向镜头。把整张图的描述塞进重绘框,模型会认真地在那个小框里再画一个模特——它不知道框外还有一张图。至于否定式,写不要六根手指几乎没用:这句话里六根手指这个概念仍然被写进了条件。这条你能自己验,方法在末一问。

有一件事我不替你拍板:选区要不要扩到腕关节以上。扩过去,模型能看到小臂朝向;可选区越大,要重画的内容越多,和周围保持一致越难——局部重绘教程也提醒过选区不宜过大。两股力气往相反方向拉,谁赢取决于你的图,这正是值得自己跑一次对照的地方:一组只框住手,一组把选区扩到腕关节以上,其余全固定。

左侧虚线框只框住手,右侧扩到腕关节以上带小臂 图注:两种选区各跑一组

都改到位还是长不对,那就接受旧文的判断:这是系统性失败区,别在同一块区域磨第三遍第四遍。每一遍重绘都是在上一遍的结果上再采样,边界一次比一次软,远看是一块可疑的模糊斑。局部重绘教程讲的多次迭代,每一轮都在改描述词、改选区,那才叫迭代;同一句描述词、同一个框反复跑,叫重复抽签。

生图比人像精修多一条路,这就是两篇结论看起来不一样的全部原因:分流法讲的是拍出来的照片,原图是既成事实,你只能在它身上改;AI 生图整张图都是抽出来的,可以直接换一次抽样——重生成。

Q:关节姿态和整只手的透视错了,为什么框住手重绘救不回来?

因为重绘框里的上下文本身就是错的。局部重绘成立的前提,是框外那圈信息(手腕方向、小臂位置、光照来向)是对的,模型照着它把框内补齐;姿态错和透视错,坏的正是这圈关系。你会得到一只框里看着挺自然、拉远一看还是拧着的手——重绘画得越精细,它越理直气壮地接着错。

姿态错走重生成,顺手把手的动作降一级:自然垂放、插兜、放在身侧,都比比心、捏笔、绕着杯壁好画——常见姿势样本多、自遮挡少。插兜这招有点耍赖:没有露出的手指,就没有数量问题。

透视错是全局关系错,局部窗口装不下,能选的是重生成或者换手。换手:从同一组出图里挑一张手对的抠出来(一键抠图是 PS 插件里的 AI 功能,注册送 50 张试用,订阅会员后无限生成),用变形工具对齐透视和光照方向贴回去,接缝和肤色过渡用 AI 去瑕疵修图收尾(同样归这一档)。前提是手里得有一张手对的图——哪怕打算手工修,也值得先多抽几张当素材库。

数量和透视都对、只是某个指节弯得别扭时,Photoshop 的液化比重绘划算:推一下指节,几秒钟,而且不引入新的随机性(重绘每跑一次都是新抽样,修好这里可能坏掉那里)。分流法也把液化归给这一档,提醒幅度要小。

Q:手和杯子、头发粘在一起,为什么要先清场?

因为粘连的地方缺的正是边界这条信息。手指融进杯壁的那一段,像素是连续过渡的:从皮肤色平滑滑向玻璃色,中间没有一条线说这里是手的边缘。模型读到的不是手在前、杯子在后这个空间关系,而是一团混合材质。你在这团东西上开重绘框,框里给它的上下文全是错的,它会老老实实继承这团混合,再还你一根同样长在杯壁里的手指。

所以顺序要反过来:先清场,再重画。

把粘连的那一整块连同粘上去的东西一起消掉——手指糊进了杯壁,就把那块杯壁也一并清掉,让那片区域退回成干净的背景或桌面。这一步用 AI 消除框住粘连区域、按周围内容补全(也是 PS 插件那档,订阅后无限生成)。填回来的是什么并不重要,你要的只是一块没有错误信息的画布。有了干净的底,再局部重绘把手画回去,杯子单独合成上去。

这条路贵:两步 AI,两道工序,外加时间。所以动手前先把上一问做完——缩到成片尺寸看一眼,粘连处显不显眼。显眼,这条路值;不显眼,省下来。更便宜的是预防:要出握持画面,先出空手图,物件另外合成,粘连在源头上就不存在。

Q:抽几次不中就该换路径?

没有一个通用的次数,但有一个不依赖任何百分比的道理:只要你没有改变模型能拿到的信息,重开一张就是重新抽一次签。前五次没中,不会让第六次变简单——这是独立抽样,不是越试越准。所以止损线不该由胜率来定(你也不知道自己的胜率),该由成本来定:每一次重生成都在花掉积分,也在花掉你盯着进度条的那几分钟。

一个当场能算的标准:先粗估这张图手工走完要多久(抠手、变形、修接缝,或者液化推两下指节),再看你在重抽上已经花掉多久。两者接近,继续抽就是负回报。分流法开头那个修图师,跑了三遍局部重绘都没消掉多余的手指,切回 PS 修完,事后他说的是当时判断不了——问题不在第三遍不该跑,在他手里没有一个停下来的标准。

这笔账容易记错,因为 AI 的等待是隐性成本:你不在操作,感觉不费力,时间照走。

唯一能让再抽一次变成新信息的做法,是抽之前改一个变量——描述词、手的动作、构图、参考图——而且一次只改一个。一口气改三处再抽中,你不知道是哪处起的作用,下一张图复现不了。

Q:想知道哪种写法真的有效,我该怎么自己测?

自己跑一个小对照,别信任何人报的通过率,包括这篇。手部成功率绑死在模型版本、题材、构图和描述词写法上,别人的百分比迁移不到你的图上。你需要的也不是一个数字,是知道自己那条描述词、那个构图到底有没有用——设计一个自己能跑、能重跑的对照,比抄一张别人的胜率表有用得多。

一次只改一个变量。A 组用你现在的写法,B 组只动一处:握杯改成自然垂放,或者选区从只框手改成扩到腕上,其余全固定。改两处以上,你拿到的只是一个说不清归因的差值。

判定口径写在开跑之前:放到 1:1 像素视图,手指数得清、指节数正常、手掌朝向和小臂对得上,算通过。跑完再定口径,你会不自觉地把想要的那一版判成通过——这是人的常态,不是你不诚实。

同一组跑两遍,隔开时间跑,这是这个专栏的老规矩:两遍之间的差值告诉你噪声有多大。如果 A 和 B 的差距还没有 A 自己两遍之间的差距大,那你测出来的不是效果,是运气。

样本少就别下结论。每组只有十来张时,多中一两张完全可能是随机波动。要么加样本,要么把它当成待验的猜想留着,别急着改工作流。

结论有保质期:模型换一次版本就得重测。这也是这篇不给你通过率的原因。

回到开头那只从杯壁里长出来的手指。按四类过一遍:数得清、数目不对,同时和杯壁之间找不到边界——数量错叠着粘连。先清场,在干净的底上重绘,杯子单独合成回去;重绘两遍还长不对,就照分流法切 PS。

现在轮到你了。把你那张手坏了的图摊到屏幕上,过一遍这四句:它在成片尺寸里还看得见吗;坏的是数量、姿态、透视,还是粘连;这一次重开,我改变了模型能拿到的信息吗;我停下来的标准是什么。

要是你卡在这篇没写到的格子里——手是对的但脚崩了、两只手互相穿过、合影里第三个人多长出一条胳膊——把它讲出来。下一篇从这些情况里挑,跑之前照样先写判定口径,同一组照样跑两遍。

读完,顺手做掉

图叮AI 的 Photoshop 插件需要免费安装,并在 PS 内使用;注册送 50 张试用,用完走会员套餐。

Image-2 生图和 Nano Banana 改图都在网页里使用;两边积分包不通用,各自按张扣积分,注册不送试用张数。

相关文章

推荐阅读

更多推荐(8 篇)
2026-05-03 08:01:01

宠物牵引绳商品图:修干净,还是保留织带与金属扣真实细节

宠物牵引绳商品图不能只追求干净。本文对比卖相优先和安全信息优先两种修图方案,拆织带纹理、金属扣、承重标识和交付成本,适合详情页交付前自检。

2026-04-25 10:32:25

GPT Image 2 做餐饮美食出图:菜品、饮品、外卖封面 3 类场景实操

图叮AI 接入 GPT Image 2 之后,餐饮老板问得最多的是菜品拍不出食欲、饮品冰块像塑料、外卖封面撑不过首屏。这篇按中餐/西餐/日料、咖啡/奶茶/鸡尾酒、美团/饿了么 3 条线拆开讲 prompt、参考图和翻车点,截至 2026-04 的实操结论。

2026-06-11 14:19:55

宝妈创业:手机拍童装+AI换背景做出专业主图的实操指南

没有摄影棚和单反,宝妈也能用手机拍童装、配合AI换背景做出干净专业的电商主图。本文给出手机拍童装的实用技巧、AI换背景的操作流程,以及测试不同风格的低成本运营思路。

2026-07-10 15:36:30

眼膜眼贴的产品图怎么修:金箔眼膜反光、凝胶水光拍不透、小罐装白底抠不净,按搜索词答

卖眼膜眼贴拍图,金箔款反光、水凝胶水光拍不透、月牙眼贴摆歪、小罐白底抠不净是高频坎。这篇按真实搜索词一条条答,讲图叮的材质高清修复、产品溶图打光、一键抠图修到哪,质地色泽要和实物一致,网页版和 PS 插件版都能试,效果以官网为准。

2026-07-09 14:50:04

商务衬衫怎么修:皱巴巴修回挺括,白衬衫别修成灰

商务衬衣买的是挺括、干净、正式,可平铺拍出来一件比一件皱、领型还塌。这篇按 6 步用图叮的局部重绘、材质高清修复、一键抠图、服装上身、产品溶图打光把衬衫修回熨烫过的样子,讲清褶皱怎么平、白衬衫怎么保住白,网页版和 PS 插件版都能做。

2026-07-03 11:52:00

食品包装产品图怎么修才突出材质卖点:磨砂、烫金、塑封分开处理

食品包装的卖点常常在材质:磨砂、烫金、塑封、牛皮纸。修没了材质,包装就廉价。这篇按认材质、打光显材质、修复救纹理、清杂不伤肌理、验收 5 步,讲食品包装产品图怎么把材质卖点修出来。

2026-07-10 10:14:54

婚礼摆台桌花怎么修:现场杂物清出去、花材氛围留下来

婚礼摆台桌花现场拍出来背景有电线纸箱、光偏暗黄、桌面留白不够?这篇按 5 步用图叮的选区消除、一键抠图、材质高清修复、产品溶图打光处理摆台桌花图,讲清怎么清杂物又不改花材摆法,效果以图叮官网为准。

2026-07-04 21:15:24

玉石文玩白底主图怎么做?抠干净、补对光、质感撑得住

玉石文玩上架卡白底主图,料小反光边缘难抠。这篇讲怎么用图叮的一键抠图、产品溶图打光和材质高清修复做一张既合规又干净的白底主图,以及白底再好看也不能改动种水成色误导买家。