ai-optimization-job-dedup-software-format.md 7.3 KB

AI 提号优化任务表(去重后,软件端格式)

本文档把“给 AI 布置的提号 SOP 长期优化任务”压成一张去重表,字段完全沿用软件端博主名单格式,方便软件端、商务看板或任务系统直接展示。这里的“博主名称”对应任务名称,“主页链接”对应任务入口或验收入口。

去重原则

  • 同一类补证动作只保留一行,例如真实历史 Brief、参考账号、人工名单、客户选择和人工补号基线统一归到“真实历史 Brief 数据集”。
  • 同一类视频动作只保留一行,例如参考视频、候选视频、封面、字幕、帧图和 A/B 验收统一归到“真实视频证据 A/B”。
  • package 验收、泄密扫描、乱码扫描、软件端表 smoke 和状态审计统一归到“运行前健康检查”。
  • 参考账号拆解和主页近期内容证据合并,避免同一条风格/调性要求重复出现。
  • 客户效果、人工复核、负样本归因和二轮记忆保留为不同闭环,因为它们的负责人、输入和验收口径不同。

软件端格式任务表

brief编号 策略 排名 平台 博主名称 综合分 brief匹配分 参考风格分 主页证据分 视觉质感分 调性一致分 证据加分 证据风险扣分 推荐理由 风险提示 主页链接 人工复核标签
OPT-001 运行前检查 1 技能包 基础链路健康检查 100 100 0 0 0 0 0 0 让 AI 先确认 package、MCP、mock provider、软件端表、视频 A/B smoke、泄密扫描、乱码扫描和状态审计全部可跑通。 只能证明链路可用,不能证明真实命中率;任何 token、sessionToken、Authorization、模型 key 不得写入文件、日志或输出。 npm run acceptancenpm run acceptance:providers:mocknpm run hygiene:smoke 必须通过
OPT-002 真实数据准备 2 商务数据 真实历史 Brief 数据集 100 100 80 80 0 80 20 0 准备 5-10 个真实历史 Brief,包含客户原始 Brief、参考账号或参考视频、人工最终名单、客户选中/拒绝记录、拒绝原因和历史人工补号量基线。 缺客户选择、拒绝原因或人工补号基线时,只能做流程验证,不能宣称客户效果达标。 outputs/data-intake-pack-latest/history-data-template.csvnpm run history:audit -- --strict 待补真实数据
OPT-003 受控真实召回 3 Live 召回 真实接口基线长跑 96 100 40 60 0 50 10 0 用真实运行时 token 和真实 provider 小规模跑基础召回,记录接口可用性、召回数量、候选池规模、失败原因、重复键和排名连续性。 接口 200、sample 模式、provider fallback 都不能单独证明提号率提升;失败时先修鉴权、召回、provider 或输出结构。 npm run live:preflight -- --strictnpm run overnight:quality 待真实长跑
OPT-004 参考与主页证据 4 证据增强 参考账号拆解和主页近期内容 98 92 100 100 90 95 25 0 拆解客户参考账号的类型、调性、内容结构、场景和表达方式,并分析候选主页近期内容、封面、标题、互动、发布时间和风险信号。 多参考账号风格冲突时不得强行合并;占位证据不得支撑强推荐;明显下沉、低质、竞品密集或调性跑偏账号不得进入强推荐。 referenceStyleHitPointshomepageEvidenceHitPointshomepageQualityRisks 待真实 provider
OPT-005 视频证据增强 5 视频分析 真实视频证据 A/B 99 92 100 90 100 100 30 0 用真实参考视频和真实候选视频 URL 调用视频分析,比较无视频证据和有视频证据两组,验证 Top10 质量、参考风格分、证据命中候选和强推荐数是否提升。 没有真实参考视频和真实候选视频时只能标记待补证据;不得把视频接口 200 当成命中率提升证明。 outputs/video-intake-pack-latest/video-resource-template.csvnpm run acceptance:video-ab 缺真实候选视频
OPT-006 扩大召回重排 6 策略矩阵 结果优先候选池优化 97 100 90 90 85 90 25 5 在本轮不优先考虑成本的前提下扩大候选池,再按 Brief 匹配、参考风格、主页证据、视频证据、硬规则和风险扣分统一重排。 扩大召回不得降低硬性规则门槛;硬规则违规率必须为 0;软件端重复键必须为 0;每个 Brief 排名必须连续。 aggregate-summary.jsonmanual-review-sample.csvnpm run candidate-pool:smoke 待矩阵对比
OPT-007 软件端交付 7 软件端输出 去重博主交付表 100 100 80 80 80 80 20 0 最终博主名单必须使用固定表头和 UTF-8 BOM,按全局博主唯一去重;同一平台加规范化主页链接不得重复,缺链接时同一平台加规范化博主名称不得重复。 已剔除账号不得进入交付表;重复键不为 0、排名不连续、中文乱码或表头不一致均视为不通过。 docs/software-client-table-format.mdnpm run software:smoke 必须通过
OPT-008 人工复核闭环 8 商务复核 负样本归因和二轮记忆 97 95 90 90 90 95 25 0 商务标注可直接发客户、商务复核、可投但需补证、跑偏、硬性规则违约、调性不符、主页质感不符、参考账号不像;负样本必须填写归因并写入二轮记忆。 负样本归因覆盖率不到 100% 时不允许升级规则;同类反馈连续出现 3 次以上才建议升级为团队规则。 manual-review-sample.csvnpm run review:metrics -- --stricttihao-preference-memory.json 待商务标注
OPT-009 客户效果审计 9 效果审计 客户选中率和人工补号减少 100 100 90 90 80 90 30 0 用真实客户反馈证明客户选中率、参考链路客户选中率、历史人工补号基线、本轮人工补号量和人工补号减少率,并沉淀每轮命令、输出目录、provider 状态和失败边界。 缺任一客户效果字段时只能标记为 blocked_by_external_data,不得宣布长期优化完成。 npm run customer-effect:audit -- --strictnpm run evidence:indexnpm run round:deposition 待客户反馈

软件端验收口径

检查项 通过标准 自动化入口
表头固定 表头与 docs/software-client-table-format.md 完全一致。 npm run software:smoke
全局去重 全局 URL 重复组为 0;缺链接时全局平台加名称重复组为 0;软件端重复键为 0。 npm run software:smoke
排名连续 每个 brief 内排名从 1 开始连续。 npm run software:smoke
中文编码 CSV 使用 UTF-8 BOM,Excel 打开中文不乱码;Markdown 文件用 UTF-8 打开不乱码。 npm run software:smoke
真实证据 sample/smoke/provider fallback 不算业务证明;模板和接口 200 也不能单独证明命中率提升。 npm run evidence:index
客户效果 客户效果不可宣称,除非真实客户选择、拒绝原因和历史人工补号基线齐全,并通过客户效果审计。 npm run customer-effect:audit -- --strict