WeChat (南鸢 nuyoah)
creative-aiai-toolsimage-generation
Original source

我做了一个专门反推人像的 Skill,但它不负责 1:1 复刻

Summary

南鸢分享了一个专门做人像图片反推(reverse prompt)的 GPT Skill,核心理念是「不复刻原图,而是保住视觉结构」。

核心定位

  • 不是猜原作者的 Prompt,也不做 1:1 复刻
  • 把人像中值得保留的视觉关系翻译成中文可读、可修改、能继续生图的提示词
  • 加入了作者对构图、脸部可见性、视线、姿态、光线和质感的审美判断

反推重点处理的维度

  1. 真实画幅和构图(不凭感觉猜比例)
  2. 人物位置、占比、裁切与脸部可见范围
  3. 虹膜方向、眼白分布、眼睑压力、嘴唇状态
  4. 手臂入画方向、手指接触、人物与道具连接关系
  5. 固有颜色 vs 现场光线 vs 曝光处理 vs 后期质感的区分
  6. 优先级排序:哪些关系必须执行,哪些装饰允许模型自由发挥

关键设计哲学

  • 「脸部可见性 + 构图裁切 + 关键动作 + 接触关系」优先于装饰数量
  • 不要求每根手指角度一致 — 把重要关系说清楚,给模型组织姿态的空间
  • Prompt 写到了 ≠ 模型一定做到(构图先验、随机性、能力边界)
  • 问题分三种:① 反推时没观察到 ② 观察到但权重不够 ③ Prompt 清楚但模型简化

色卡模式

  • 不是贴几个好看色块,而是标注主色/暗色/跳色的比例关系
  • 例:雾青绿 45% 为环境基底、深色 9% 压画面、浅青白 5% 只用在高光
  • 建议色卡 + 完整反推词一起交给生图模型

推荐搭配

  • GPT-5.6 sol(处理高信息密度中文规则、关系推理、组织反推词)
  • 最终像素由图像生成模型完成,两个环节分开

安装使用

npx skills add nuyoah-ai-works/nuyoah-image-reverse-prompt -g -y

上传参考图后说:「使用南鸢图片反推拆解这张参考图,给我参考色卡和可直接生图的完整中文提示词」

能力边界(明确声明)

  • 不能恢复原始 Prompt、不能保证五官服饰一模一样
  • 不能单次生成严格执行复杂手势/非对称构图
  • 不能猜品牌、相机型号、不可见区域
  • 反推和生图是两个不同任务,未授权不会擅自生图