Fmode Image Set V3真实验收清单
当前基线结论:用户已判定“无字底图 + Sharp/Pango后置文字”的视觉效果很差。以下清单分别记录工程链路和真实视觉质量;即使工程项通过,也不得将当前后置文字版本标记为商业质量通过。
准备
- 在VSCode Claude Code中使用新的无敏感商品附件;
- 确认七牛、Jimeng和视觉观察/区域Provider配置;
- 图片预计生成九张、费用
1.98 元;辅助模型usage另行记录;
- 真实付费验收由用户执行,不修改历史run。
完整流程
- 上传一张商品图,用一句自然需求要求直接生成七图。
- Claude应在同一用户请求中连续调用
start → generate_references → generate_set,聊天附件场景不传image,阶段间不再询问用户。
- 检查三视图第二列是水平45度观察,商品没有倾倒。
- 检查
setting-board-visual.png没有模型新增文字,setting-board-annotated.png含可识别中文;内容与当前商品匹配而非通用模板,并单独记录其视觉质量。
- 检查
claude-reference-authoring.json和claude-authored-set-plan.json均标记authored_by=claude并绑定前阶段哈希。
- 检查
prompt-plan.json 七个Prompt都声明只生成当前一张单图,并且只引用两张生成参考资产。
- 检查视觉底图为01白底、02/03卖点、04/05场景、06/07购买决策,且没有模型新增营销文字。
- 检查
layout-regions.json 与七张底图URL哈希绑定,只输出几何区域。
- 对实验性后置文字版本检查中文完整、无乱码、无语义截断,不遮挡商品、人脸、Logo和包装原字;这些工程项不能替代版式、层级、风格融合和商业审美验收。
- 无安全区页面应使用信息面板或扩展画布,不直接覆盖商品。
- 检查
layout-report.json 记录字体、字号、换行、选区、碰撞和兜底路径。
- 检查图片费用、辅助模型调用次数和usage分别记录。
中断恢复
- 参考图失败:七图不启动,同run resume;
- Claude阶段合同结构失败:修复同一阶段输入;等待Claude输入的resume不得产生外部调用;
- 七图技术失败:已完成图位不重提,
submission_unknown不盲目重提;
- 区域或排版失败:保留九张已付费图片,同run resume只继续后处理;
- 完整run再次resume:Jimeng提交增量0,视觉观察和区域模型调用增量0。
多商品和平台对照
- 至少测试可穿戴、包装商品和硬质设备三类商品;
- 同一商品至少比较淘宝和另一个平台;
- 检查不同平台在构图、主体比例、视觉节奏、人物/场景权重和文字布局上具有可解释差异;
- 检查六张非白底图不是同一模板换背景。
工程链路通过标准
- 观察→Claude动态设定板→2→观察→Claude七页设计→7→区域→排版阶段完整;
- 七图无原图;
- 1+2+2+2定位正确,同定位两页任务和视觉证明不同;
- 材质、颜色和关键识别元素人工检查可接受;
- 后置文字无乱码、无语义截断且无关键区域碰撞;
- 恢复不产生重复图片或辅助模型调用;
- 费用和边界说明真实。
视觉质量通过标准
- 字体、字号、层级、字距、行距、对齐、色彩、材质、信息卡和画面风格形成统一设计系统;
- 文案与商品视觉建立自然关系,而不是像通用UI面板覆盖在底图上;
- 至少与目标竞品样本进行盲评或并排评审,并达到预先约定阈值;
- 当前版本未达到以上标准,真实验收结果应记录为不通过。