live-manual-acceptance-checklist.md 3.6 KB

Fmode Image Set V3真实验收清单

当前基线结论:用户已判定“无字底图 + Sharp/Pango后置文字”的视觉效果很差。以下清单分别记录工程链路和真实视觉质量;即使工程项通过,也不得将当前后置文字版本标记为商业质量通过。

准备

  • 在VSCode Claude Code中使用新的无敏感商品附件;
  • 确认七牛、Jimeng和视觉观察/区域Provider配置;
  • 图片预计生成九张、费用 1.98 元;辅助模型usage另行记录;
  • 真实付费验收由用户执行,不修改历史run。

完整流程

  1. 上传一张商品图,用一句自然需求要求直接生成七图。
  2. Claude应在同一用户请求中连续调用start → generate_references → generate_set,聊天附件场景不传image,阶段间不再询问用户。
  3. 检查三视图第二列是水平45度观察,商品没有倾倒。
  4. 检查setting-board-visual.png没有模型新增文字,setting-board-annotated.png含可识别中文;内容与当前商品匹配而非通用模板,并单独记录其视觉质量。
  5. 检查claude-reference-authoring.json和claude-authored-set-plan.json均标记authored_by=claude并绑定前阶段哈希。
  6. 检查 prompt-plan.json 七个Prompt都声明只生成当前一张单图,并且只引用两张生成参考资产。
  7. 检查视觉底图为01白底、02/03卖点、04/05场景、06/07购买决策,且没有模型新增营销文字。
  8. 检查 layout-regions.json 与七张底图URL哈希绑定,只输出几何区域。
  9. 对实验性后置文字版本检查中文完整、无乱码、无语义截断,不遮挡商品、人脸、Logo和包装原字;这些工程项不能替代版式、层级、风格融合和商业审美验收。
  10. 无安全区页面应使用信息面板或扩展画布,不直接覆盖商品。
  11. 检查 layout-report.json 记录字体、字号、换行、选区、碰撞和兜底路径。
  12. 检查图片费用、辅助模型调用次数和usage分别记录。

中断恢复

  • 参考图失败:七图不启动,同run resume;
  • Claude阶段合同结构失败:修复同一阶段输入;等待Claude输入的resume不得产生外部调用;
  • 七图技术失败:已完成图位不重提,submission_unknown不盲目重提;
  • 区域或排版失败:保留九张已付费图片,同run resume只继续后处理;
  • 完整run再次resume:Jimeng提交增量0,视觉观察和区域模型调用增量0。

多商品和平台对照

  • 至少测试可穿戴、包装商品和硬质设备三类商品;
  • 同一商品至少比较淘宝和另一个平台;
  • 检查不同平台在构图、主体比例、视觉节奏、人物/场景权重和文字布局上具有可解释差异;
  • 检查六张非白底图不是同一模板换背景。

工程链路通过标准

  • 观察→Claude动态设定板→2→观察→Claude七页设计→7→区域→排版阶段完整;
  • 七图无原图;
  • 1+2+2+2定位正确,同定位两页任务和视觉证明不同;
  • 材质、颜色和关键识别元素人工检查可接受;
  • 后置文字无乱码、无语义截断且无关键区域碰撞;
  • 恢复不产生重复图片或辅助模型调用;
  • 费用和边界说明真实。

视觉质量通过标准

  • 字体、字号、层级、字距、行距、对齐、色彩、材质、信息卡和画面风格形成统一设计系统;
  • 文案与商品视觉建立自然关系,而不是像通用UI面板覆盖在底图上;
  • 至少与目标竞品样本进行盲评或并排评审,并达到预先约定阈值;
  • 当前版本未达到以上标准,真实验收结果应记录为不通过。