我做了一个专门反推人像的 Skill,但它不负责 1:1 复刻
- URL: https://mp.weixin.qq.com/s/Z76Aw-pncUg91a0WvxHYWA
- Date Saved: 2026-08-14
- Source: WeChat (南鸢 nuyoah)
- Tags: creative-ai, ai-tools, image-generation
Summary
南鸢分享了一个专门做人像图片反推(reverse prompt)的 GPT Skill,核心理念是「不复刻原图,而是保住视觉结构」。
核心定位
- 不是猜原作者的 Prompt,也不做 1:1 复刻
- 把人像中值得保留的视觉关系翻译成中文可读、可修改、能继续生图的提示词
- 加入了作者对构图、脸部可见性、视线、姿态、光线和质感的审美判断
反推重点处理的维度
- 真实画幅和构图(不凭感觉猜比例)
- 人物位置、占比、裁切与脸部可见范围
- 虹膜方向、眼白分布、眼睑压力、嘴唇状态
- 手臂入画方向、手指接触、人物与道具连接关系
- 固有颜色 vs 现场光线 vs 曝光处理 vs 后期质感的区分
- 优先级排序:哪些关系必须执行,哪些装饰允许模型自由发挥
关键设计哲学
- 「脸部可见性 + 构图裁切 + 关键动作 + 接触关系」优先于装饰数量
- 不要求每根手指角度一致 — 把重要关系说清楚,给模型组织姿态的空间
- Prompt 写到了 ≠ 模型一定做到(构图先验、随机性、能力边界)
- 问题分三种:① 反推时没观察到 ② 观察到但权重不够 ③ Prompt 清楚但模型简化
色卡模式
- 不是贴几个好看色块,而是标注主色/暗色/跳色的比例关系
- 例:雾青绿 45% 为环境基底、深色 9% 压画面、浅青白 5% 只用在高光
- 建议色卡 + 完整反推词一起交给生图模型
推荐搭配
- GPT-5.6 sol(处理高信息密度中文规则、关系推理、组织反推词)
- 最终像素由图像生成模型完成,两个环节分开
安装使用
npx skills add nuyoah-ai-works/nuyoah-image-reverse-prompt -g -y
上传参考图后说:「使用南鸢图片反推拆解这张参考图,给我参考色卡和可直接生图的完整中文提示词」
能力边界(明确声明)
- 不能恢复原始 Prompt、不能保证五官服饰一模一样
- 不能单次生成严格执行复杂手势/非对称构图
- 不能猜品牌、相机型号、不可见区域
- 反推和生图是两个不同任务,未授权不会擅自生图