销售侧客户引擎试点方案(PR7 语料对齐)
权威:见 ../CURRENT_STATE.md · 日期:2026-09-22
语料:MP3 PR #7(已合并)research_corpus/2026-09-21 · 对照:../syntheses/pr7-corpus-vs-engine-2026-09-21.md
主卡:../cards/K-019-sales-pilot-with-pr7.md
范围:只做销售侧。 「一期是否只做维修进度」仍待裁定,本方案不覆盖。
人话导读(先读)
PR7 是什么: 一份脱敏、假名的研究用录音转写与分析快照(默认可提取转写约 369 份等)。用来练「听懂再考虑」这条链。它不是生产库备份,不是人工金标,不是不可逆匿名证明。
为何先离线: 演示 CRM 业务表基本是空的;客户主 ID 抽样大量为空;约 90GB 原音频未进包。先在文本上做出「召回犹豫会话 → 证据可点回 → 理解卡 → 对照现有建议 → 失败样本本」,再谈接真实身份与跟进回执。否则容易拿空表报战果。
不能当战果: 没有真实跟进/成交回执时,规则生成的「下一步建议」只是草稿。可以说「卡片好不好读、顾问认不认」,不能说「成交率提升了」。
本期范围: 锁定销售场景 A(试驾后「再考虑」);维修进度另裁。不自动外呼打客户;不平行第二套客户真相。
白话目标: 客户试驾后说「再考虑」时,顾问打开工作台就能看到——我们听懂了什么、证据在哪、还缺什么、下一步建议什么——顾问确认后再行动。
1. 我们有什么(PR7 vs 现网 Voice Platform / CRM)
| 能力块 | PR7 研究语料(云端已有) | 现网 Voice Platform(嘴耳) | 现网 CRM / 业务表 | 对销售试点含义 |
|---|---|---|---|---|
| 感知 · ASR 文本 | 主链 own_asr 387(默认可用 369);全量 recording_refs;假名稳定 | 主链 data/transcripts/qwen3asr/;ASR 路由/纠错 slot | — | 可离线回放「再考虑」证据链 |
| 客户快照 · customer_view | 快照类 518(抽样已读 173 份 customer_view) | customer_view / thread / advisor_weekly 合同与 builder | 演示库;原始 CRM 业务表为空 | 有「理解草稿」形态;无真实成交回执 |
| 下一步动作 | NBA 字段在抽样中覆盖率高;规则含「再考虑」分支 | scenes/sales/next_action.py(hesitation / send_quote / 试驾推进等) | 无可靠写回闭环 | 适合顾问建议卡;不能当效果证明 |
| QA / 复核 | QA 7341;复核候选≠金标 | ReviewStore / FeedbackCase | — | 可找失败样本;不能当教师标签 |
| 模型观测 | 约 10万+ 请求响应 | Model Lab / harness | — | 成本与失败研究;禁止自动蒸馏成真值 |
| 合作方 / 隔离 | 默认 不提取(需 --allow-reference) | 不得写回主链 transcript | — | 试点输入只用我方主链 |
| 原始录音 | ~90GB 未上传;仅清单 | 本地音频链路 | — | 首期文本试点可开;说话人/CER 需受控对象存储 |
| 隐私审计 | privacy-audit.json:自动化检查通过;非不可逆匿名 | 生产主链另管 | — | 假名可分析;勿输出可还原身份 |
规模要点(已核实,文件数≠客户数): 146k 源文件 → 64k 去重对象 ≈216MB gzip;演示 CRM / SaaS fixture 不能当真实反馈。
抽样关键数字(2026-09-21 云端拉取 catalog + objects 分片)
| 项 | 数字 | 读法 |
|---|---|---|
| own_asr 默认可提取 | 369 / 387 | 18 份质量隔离已排除;100% 有 recording_refs |
| ASR 文本抽样 | 80 份 | 「再考虑/观望…」约 49/80;购车意向词约 67/80;承诺/约定口吻约 33/80(关键词粗筛,非金标) |
| customer_view 已读 | 173 份 | 另有 254 份 customer_view + 42 weekly + 32 daily 未装入本机分片 |
conversation_id 非空 | 173/173 | 会话可回放 |
customer_master_id 非空 | 0/173 | 可靠客户 ID 缺口 |
| 姓名 FieldView | missing 122 / manual_review 32 / validated 10 | 身份弱 |
| 手机 FieldView | missing 171 / validated 2 | 留资弱 |
intent_grade 非空 | 149/173(86%) | 有等级草稿 |
next_best_action 非空 | 173/173 | 有建议草稿 |
objections / focus_points | 62% / 64% | 阻碍与关注点中等覆盖 |
purchase_timeline / test_drive_intent | 25% / 41% | 时间线与试驾意向偏稀 |
| 含犹豫措辞的快照 → NBA | send_quote 最多,其次 capture_contact、试驾推进、schedule_follow_up | 与场景 A「再考虑」相关,但需顾问确认,禁用不实测 % |
2. 缺什么(开工前必须看见)
- 金标: 人工确认的转写、角色归属、否定/自我修正、关键金额/车型时间窗;现有 ASR/模型 judge/合作方对照 ≠ 真值。
- 真实跟进 / 成交回执: 到店、试驾、跟进采纳/拒绝、订单;PR7 写明 CRM 业务表空、演示库不能证明提升。
- 音频受控存储 + clip manifest: ~90GB 声音未进 Git;说话人、CER/WER、语气实验依赖对象存储,不塞仓库。
- 可靠客户 ID: 抽样 customer_view 的
customer_master_id全空;缺 ID 的会话 禁止推断合并(对齐语料纪律与 K-015)。 - 任务上下文合同落地: 现有 NBA/洞察是 pipeline 输出;引擎要的「当前理解 + 待确认 + 可办动作」尚未与 CRM 顾问台统一(K-018)。
3. 试点目标(场景 A)
对齐审阅默认与 scenarios/A-sales-next-action.md:
触发: 试驾后客户表达「再考虑 / 观望 / 回去商量」或顾问点「下一步」。
交付: 整理——已知需求 / 候选阻碍 / 未验证假设 / 建议体验动作 / 需澄清项;事实与推断分栏;证据可点回 ASR 片段。
成功样子: 顾问更快看懂「这个人现在卡在哪」;约定被记下且可兑现核对;促进合适购买,不优化施压。
明确不做: 不自动外呼打客户;不把未验证阻碍写成客户事实;不平行第二客户真相;本期不做维修进度(K-013)。
4. 最小架构(先小而可靠)
感知(ASR已有)
→ 证据引用(recording_ref + 片段/轮次)
→ 当前理解 + 待确认(意图/阻碍/时间线;分栏)
→ 任务上下文(事项级一小份资料 + 能力目录,≠执行接口)
→ CRM / 顾问工作台展示 → 顾问确认(人在回路:高风险须人点头)
→(暂缓自动外呼)
→ 结果回写学习(采纳/拒绝/约定兑现;进经营知识,不直写主数据)
| 层 | 谁做 | 首期约束 |
|---|---|---|
| Voice Platform | 嘴耳:ASR、会话证据 | 不另立真相库 |
| 客户经营大脑 | 理解 + 上下文 + 受控建议 | RDB 基线;不全家桶;LLM 不直写库 |
| CRM 顾问台 | 展示与确认入口 | 正式订单/价格仍归业务系统(K-015) |
| Action | 人确认后的触达 | 一期不做自动外呼(K-008) |
5. 首期模块清单
5.1 能用 PR7 文本先跑(离线回放)
| 模块 | 做什么 | 数据入口 |
|---|---|---|
| M1 犹豫会话召回 | 从 own_asr + customer_view 捞「再考虑」及同类 | extract --category own_asr;snapshots |
| M2 证据引用打包 | 理解句 ↔ recording_ref / turn | ASR segments + view |
| M3 理解卡草稿 | 需求 / 阻碍 / 未验证 / 缺口 | intent、objections、focus_points… |
| M4 NBA 对照评测 | 规则 NBA vs 顾问标注「更合理下一步」 | next_action 字段 + 人工小样本 |
| M5 失败样本本 | QA/复核里漏判误判 | qa_review(候选≠金标) |
5.2 必须接 CRM · 业务表才能闭环
| 模块 | 为什么必须接 |
|---|---|
| C1 客户身份绑定 | master_id 空则无法跨会话事项 |
| C2 跟进任务落台 | 顾问确认后的下一步要进工作台 |
| C3 结果回写 | 采纳/拒绝、是否再联系、是否成交 |
| C4 承诺账本最小项 | 「何时回电/发方案」等约定;不缩成催办(K-005) |
6. 评测(事项级;禁用不实测 %)
按事项(一条「试驾后再考虑」跟进链)记账,不用材料里的 80%/50% 等作验收线:
| 指标 | 怎么量 | 不要怎么吹 |
|---|---|---|
| 需要是否抽对 | 顾问/金标:阻碍与缺口是否点对 | 不用模型自评分代替 |
| 顾问耗时 | 打开上下文到发出确认动作的时间 | 不以「建议条数」验收 |
| 约定兑现 | 记下的回电/到店/发方案是否按期发生 | 不以演示库成交率 |
| 证据可追溯 | 每条理解能否点回片段 | 不以文件量当样本规模 |
14 天若做接通演练:只测可读可点开,不测 NPS/留存证明。
7. 风险与不做清单
风险(人话): 客户 ID 空容易把两人合成一人;把研究快照当成正式业务账;用演示空表报「提升了」;把合作方语料混进主链;没人工金标就当老师教模型;音频没脱敏就上传。
不做(销售试点一期): 自动外呼打客户;自动改价/发券;全面 NBA;论坛对个人;跨店推荐;平行第二客户真相;LLM 直写业务库;Vector 当真相底座;Graphiti/LangGraph/Iceberg 默认全家桶;把 PR7 模型输出当教师金标;把 K-013 维修进度偷换成销售试点范围。
8. 给亮哥的拍板(≤3 条)
- 场景确认: 销售试点锁定 场景 A「试驾后 / 再考虑」下一步(全站审阅默认);本期不做维修进度主场景(K-013 另裁)。
- 数据接入优先级: ① 真实客户 ID 绑定 + 跟进/成交回执进业务表 → ② 顾问台任务回写 → ③ 音频受控对象存储;演示 CRM / 空业务表不得当效果证据。
- 路径选择: 先离线回放 PR7 文本语料(M1–M5)做出事项级评测基线,再接 CRM 闭环(C1–C4);未完成离线基线前不上自动触达。
导航
- 语料入口(仓库):
research_corpus/2026-09-21/README.md·INVENTORY.md·docs/experiments/cloud-analysis-corpus.md - 引擎权威:../CURRENT_STATE.md · K-009 / K-015–K-018 / K-006 / K-008
- 对照合成:../syntheses/pr7-corpus-vs-engine-2026-09-21.md