user-workflow.md 9.6 KB

用户工作流

商务 SOP

  1. 接收客户 Brief,可以是文件、表格、纯文本、产品介绍、客户聊天记录,或商务口述。
  2. 提取客户、品牌、品类、平台、目标数量、粉丝区间、预算、CPE/CP1/CPM、男女粉占比、城市、风格偏好、参考账号/视频、排除项、地域和交付要求。
  3. 先把需求拆成三层:
    • 硬性量化指标:平台、粉丝、地区/城市、预算、CPE/CP1/CPM、男女粉占比、互动、目标数量、明确排除项。
    • 产品/人群隐性规则:产品适合什么人群、什么场景、什么账号类型;例如脱毛仪/美容仪默认偏女性使用场景和女性博主,不能把男性泛账号标为强推荐。
    • 风格调性证据:参考账号、内容形式、主页封面质感、最近 10-20 篇内容一致性、人物/场景/商业强度,以及宽类目拆出的子方向。
  4. 如果 Brief 有参考账号或参考链接,先判断参考账号的可参考性:
    • 是否能作为类型锚点。
    • 是否能作为调性锚点。
    • 多个参考账号风格是否一致。
    • 如果参考账号风格彼此冲突,只能作为客户偏好线索,不能强行生成统一风格标准。
  5. 对参考账号或候选账号,按人工提号顺序看证据:
    • 先看最近 10 篇左右内容的封面和标题,判断垂类、质感、场景和调性。
    • Vlog 看是否有生活分享、风景、社交场景或真实记录;颜值账号可以是自拍,但非颜值需求不能把纯自拍当作生活方式适配。
    • 美食/探店看食物、店铺、门面/门头和同城场景;美妆要拆妆教步骤、测评合集、日常妆容或护肤方向;穿搭要拆港风、成熟风、通勤、女装/男装等子类。
    • 报价 300 元以上的账号要更严格看画面清晰、背景统一、封面稳定和内容精致度;300 元以下可相对放宽但不能接受明显低质/混乱/搬运。
    • 复核近 30 天是否有更新、近作平均点赞是否百赞以下、是否多篇出现同一批评论者;停更或疑似刷评不要强推。
    • 如果封面判断不出来,再看图文正文或视频内容。
    • 如果仍不确定,再进入视频帧、ASR 或豆包分析。
    • 机器可以在低置信度时扩大到 20 篇或更多,但报告必须说明证据来源。
  6. 如果 Brief 或用户消息里有参考视频链接,先做参考视频补证:
    • 识别链接平台、内容类型、noteId 或短链。
    • 使用公司 VOC social proxy:https://server.fmode.cn/api/voc-social
    • 使用 Parse sessionToken 作为 Authorization: Bearer <Parse sessionToken>
    • 小红书视频详情路径:xiaohongshu/app_v2/get_video_note_detail
    • 从详情里提取标题、正文、作者、视频 URL、封面、字幕、帧图资源。
    • 再把这些资源交给 Doubao 视频分析服务,模型默认 doubao-seed-2-0-pro
  7. 生成候选池:优先使用已有缓存和样例校准;不足时用 live 模式调用公司 voc-e-commerce 代理。
  8. 分平台选择召回路径:
    • 小红书/蒲公英:优先利用参考账号和相似账号推荐链路,再做类型和调性二次筛选。
    • 抖音/星图:星图标签只作为入口;星图搜不到或标签不准时,提示改用 APP 关键词搜索、招募或人工补找。
    • 平台标签不等于适配证据,必须回到主页最近内容、产品子类和客户聊天偏好复核。
  9. 按 Brief 匹配、参考视频风格匹配、最近主页内容证据、预算健康度、数据完整度、隐性规则、风险/排除项排序。
  10. 视频分析 evidence card 命中后,必须回写候选人的参考风格命中点、参考风格分、总分,并重新排序。
  11. 输出强推荐、备选、需复核、已剔除四类;已剔除只供内部复盘,不进入商务可用名单。
  12. 检查 provider 状态:参考视频补证、多模态证据卡、live 召回是否为 ok。不是 ok 时写成待补证/待复核,不能宣称已完成视频分析。
  13. 商务复核主页、报价、合作状态、近期内容和风险点。
  14. 先回答报告里的 下一轮校准问题,再生成第二轮名单。
  15. 客户反馈和商务体验反馈进入 preference memory,下次自动并入排除项、隐性规则和风格偏好。
  16. 对反馈做分层沉淀:
    • 账号级:某个博主可发、跑偏、拉黑、需补证。
    • Brief 级:这次需求解析哪里错了。
    • 个人级:当前商务自己的审美、风险偏好、主页质感标准。
    • 客户/品牌级:某客户长期接受或拒绝的账号类型。
    • 团队规则级:多次反馈证明可复用的品类规则。
  17. 第二轮输出必须说明本轮应用了哪些反馈,哪些只是个人偏好,哪些建议升级为团队规则。

人工复核标签

商务或运营复核候选名单时,人工复核标签 列只能使用下列标签之一:

标签 用途 是否必须填写归因
可直接发客户 候选人符合 Brief、调性、主页证据和风险边界,可进入客户预览名单
商务复核 大体匹配,但报价、档期、竞品合作、近期内容或平台风险仍需确认
跑偏 人群、品类、平台、预算、场景或合作方向明显偏离 Brief
硬性规则违约 命中必须剔除项,例如平台、粉丝、预算、地域、类目或客户明确排除项不符
调性不符 硬指标可用,但内容表达、视觉质感、语气、人设或参考账号风格明显不一致
主页质感不符 最近内容质量、封面、互动、更新频率、商业化痕迹或风险信号不足以支持推荐
参考账号不像 客户给了参考账号/视频,但候选人与参考的人群、内容结构或风格相似度不足
待客户反馈 已发客户或准备发客户,但客户尚未给最终结果
客户选中 客户最终确认选择该候选人,可用于客户效果审计
客户拒绝 客户最终拒绝该候选人,必须补拒绝原因或反馈原因

负样本标签必须填写 归因类型。可用归因类型:

归因类型 说明
需求解析错 Brief 里的品类、人群、预算、平台、地域或硬性限制被解析错
隐性规则漏 客户偏好、历史排除项、风格禁区或团队经验规则没有进入筛选
召回关键词错 关键词召回方向太宽、太窄,或平台搜索词不贴合真实场景
主页证据不足 最近内容、封面、标题、互动、发布时间或风险证据不足
视频证据误判 参考视频或候选视频的风格、场景、口播、画面质感、ASR 被误判
排序权重错 候选已召回,但弱相关、低质感或高风险账号排得过高
输出解释错 推荐理由、风险提示或证据卡表达不清,导致商务难以判断
软件端表重复或排名不连续 重复键异常、排名断档、字段不稳定或软件端表格问题

复核后的验收动作

  1. 商务补完 人工复核标签归因类型反馈原因客户选择
  2. 技术/AI 运行:

    npm run review:metrics -- --input <已标注CSV> --output <输出目录> --strict
    
  3. 如果已有客户最终选择和历史基线,再运行:

    npm run customer-effect:audit -- --review-csv <已标注CSV> --history-audit <historical-dataset-audit.json> --current-manual-supplement-count <本轮人工补号量> --output <输出目录> --strict
    
  4. 未拿到真实客户选择、历史人工补号量、真实视频 A/B 或 live provider 审计前,不得宣称命中率提升或客户效果达标。

Safe Defaults

  • 默认按 live 小规模检索执行 brief-to-list 请求;不要在用户只说“丢 brief 出名单/提号/找博主”时静默切到 sample。
  • live 首轮只跑 keywordLimit=1pagesPerKeyword=1
  • sample 只用于用户明确说 sample、演示、无消耗、不用真实数据或“先跑通 SOP”的场景。
  • live 缺 token 或额度时,返回友好的 token/开通/充值提示;不要自动 fallback 到 sample,除非用户明确允许。
  • live 扩量前先确认额度、company、关键词和目标平台。
  • 有参考视频和 Parse sessionToken 时,优先启用 VOC social reference enrichment;没有视频详情资源时,只能输出“待补口播证据 / 待补帧图证据”。
  • 参考账号/视频补证统一走公司「社媒分析服务」;对外只称「社媒分析服务」,不要对客户暴露任何底层供应商名称。
  • 社媒分析服务 / Doubao / evidence provider 状态不为 ok 时,基础提号可以继续,但不能宣称参考视频风格已真实分析完成。未开通或余额不足时给客户「社媒分析服务充值」链接。
  • 强推荐不能只靠平台标签或互动数据,必须有 Brief 命中点和风格/调性证据。
  • 对调性不确定的账号,宁可标为“需复核”,不要为了凑数量标为强推荐。

商务友好提示词

  • “帮我按这个 brief 生成一版商务可复核的博主名单。”
  • “客户给了参考视频,先分析参考视频风格,再找相似调性的博主。”
  • “客户要母婴 DHA,预算 3000-18000,先找小红书妈妈/营养师类账号。”
  • “把客户反馈沉淀一下:不要硬广,不要医美,偏素人真实体验。”
  • “先回答这版报告里的下一轮校准问题,再重跑第二版名单。”
  • “这次体验反馈一下:Ulike 不要男性泛账号,主页封面太下沉的也不要,帮我沉淀到个人偏好。”
  • “把这张人工复核表里的跑偏原因总结成下轮优化建议。”