product-photo-enhancer

亚马逊电商商品图无损渲染 Skill(Codex / OpenCode 通用)。用户上传商品实拍图,Agent 引导确认需求后,生成注入 5 维防走样冻结约束的英文 Prompt 并渲染出图;每轮修改回到原始实拍图重新生成,杜绝多轮 img2img 链式退化。

核心机制

  • 原图锚定:所有生成始终从原始实拍图出发,禁止 AI 中间图接力
  • 变更累积制:追加修改合并进新 Prompt,回到原图重生成
  • 5 维冻结约束:LOGO/文字、印花图案、固有色材质、几何透视、接触阴影
  • 单次变更 ≤2 维度:缓解扩散模型注意力稀释
  • P4 目检验收:产出图对照原图逐项检查,不合格定向收紧重生成
  • 亚马逊合规预设:主图(2000×2000 纯白底)/ 副图场景图 / A+ 横幅

两个发行版

版本 目录 适用环境 形态
Agent 版 product-photo-enhancer/ Codex / OpenCode 等有文件系统与执行能力的 Agent 三层披露 Skill(SKILL.md + references + scripts)
网页版 webchat/PROMPT.md ChatGPT / Gemini 网页对话(含 Custom GPT / Gem) 单文件开场提示词(~2800 字符),粘贴即用

两版共享同一设计内核(原图锚定、5 维冻结、小步迭代、目检验收),迭代时请同步修改。

安装(Agent 版使用者)

product-photo-enhancer/ 整个目录复制到 Codex 的 skills 目录:

# Windows (PowerShell)
Copy-Item -Recurse product-photo-enhancer "$HOME\.codex\skills\"

# macOS / Linux
cp -r product-photo-enhancer ~/.codex/skills/

安装后目录应为:

~/.codex/skills/product-photo-enhancer/
├── SKILL.md
├── references/   (4 个 .md)
└── scripts/render_openai.py

出图后端(可选)

Skill 无后端依赖也能工作(降级为只产出标准化 Prompt)。如需 Agent 直接出图:

pip install openai
# 设置环境变量 OPENAI_API_KEY=<your-key>

渲染走 OpenAI gpt-image-1 edit 端点(原图 + Prompt 输入),input_fidelity=high 默认开启。

快速测试

  1. 打开 Codex,上传一张商品原始实拍图,输入:"帮我把这个商品放到大理石桌面上,温馨自然光,用于亚马逊副图"
  2. 预期:Agent 触发本 Skill → 一段话确认图位/尺寸/材质(或直接跳过)→ 在 output/ 落盘 round-01-prompt.txt → 出图 round-01.png(无 key 时仅交付 Prompt)→ 输出 5 维目检结论
  3. 追问修改:"把光改成冷调" → 预期回到原图 + 合并需求重新生成 round-02,而不是在 round-01 图上叠加

License

MIT