坑四:CSAT 没有你以为的那么硬。满意度问卷天生有抽样偏差,愿意填的多是特别满意和特别愤怒的两端,中间沉默的大多数不出声。行业数据也打架:一个来源的统计说 92% 的企业报告引入 AI 后满意度提升了,另一个来源的基准却是 AI 处理的会话满意度通常比同团队的人工低 5 到 10 分(百分制)。两个都是真数据,但一个在问企业、一个在量会话,口径根本对不上。破法:CSAT 继续收,但只当参考项,别当北极星;真正硬的体验信号是行为,比如重联系率和会话中途放弃率,客户用脚投的票不受问卷疲劳影响。
四个坑总结成一句话:对标之前先对口径,口径对不上的数字,多好看都是别人家的。
最后
写到这里,这个系列的三篇就完整了:第一篇架构,回答它能干什么;第二篇护栏,回答它怎么不出事;这一篇评测,回答它到底有没有用。三件事对应产品经理在 AI 客服项目里迟早要顶住的三次质询:立项时的”方案为什么这么设计”,上线前的”出了事怎么办”,和上线后那句一定会来的”到底好不好用”。