跳转到主要内容

难度浓缩器:AI 客服分流正在让留下的员工精疲力竭

阅读需 1 分钟Tian PanTian Pan

仪表板显示一切进展顺利。分流率高达 65%。工单量下降。单次咨询成本减半。接着,支持团队开始有人离职,离职面谈中提到了一些仪表板上没有列出的东西:“每一个班次都是煎熬。”

这是 AI 增强型支持中隐藏的机制。分流率衡量的不是消除的难度,而是浓缩后的难度。到达人工客服手中的案例不再是客户现实情况的代表性样本——它们是残余物,是 AI 无法解决的案例。而这些残余物比平均水平要沉重得多。

每一个在这种转型中运营支持组织的领导者,在三个月左右都会发现同样的事情:核心指标正在改善,而团队正在崩溃。数字在工作量方面没有撒谎,但在现在一张工单对一个人的消耗上撒了谎。

机制不在于数量,而在于构成

在 AI 时代之前,客服人员的任务队列呈现出难度的正态分布。有些工单是重置密码和确认回复——五分钟就能解决,认知负荷低,是处理难题之间的有效喘息机会。有些是涉及多个系统的 Bug 报告、账单纠纷,或者是已经愤怒的客户的升级请求。大多数工单处于中间位置。一天的工作节奏感很强。

在 AI 时代之后,简单的案例消失了。它们消失得干干净净——这就是仪表板所庆祝的部分。AI 处理了密码重置,发送了确认邮件,查询了订单状态。客服人员的任务队列以前是 50% 的简单案例、30% 的中等案例和 20% 的困难案例,现在变成了 100% 的 AI 无法分流的案例。

这里的数学逻辑简单而残酷。如果你的 AI 分流了难度最低的 65%,那么剩下的到达人工手中的 35%,根据定义,就是难度分布的最顶端。客服人员不再是处理旧工作中 35% 的量。他们是在处理最难的那 35%——长达八小时的多系统调试、客户挽留和情绪激烈的升级处理,中间没有任何简单的案例可以用来缓冲恢复。

行业数据已开始印证这一点。2025 年的一项调查发现,56% 的服务人员正在经历职业倦怠,77% 的人报告工作复杂程度逐年增加。呼叫中心的离职率在 30% 到 45% 之间。波士顿咨询公司 (BCG) 的一项研究确定了一种足以被命名的独特现象:“AI 脑烧伤” (AI brain fry),这是一种专门源于管理 AI 工具和处理其失败残余物的认知疲劳,重度 AI 使用者的离职意向增加了 39%。最积极进取的客服人员——那些承担最困难工作的人——最有可能离职。

为什么客户出现时已经愤怒了

还有一个被运营者低估的复合效应,直到他们亲身经历。当客户找到人工客服时,他们已经和 AI 交流过了。通常是两次,甚至是三次。而那个导致升级的对话,往往是 AI 搞错了,或者虽然搞对了但毫无帮助,或者拒绝了客户认为合理的请求。

这意味着人工队列中不仅是更难的案例,更是与已经受挫的客户挂钩的更难案例。客服人员继承了 AI 在移交前与该客户进行的每一次失败互动所产生的“情绪债”。人工对话的开场白不再是“你好,我有一个问题”,而是“我已经试过两次了,你们的机器人根本没用。”

在 AI 时代之前,这个问题也存在,但比较轻微。升级到二线支持的客户通常只经历过一次糟糕的体验。在 AI 时代,AI 变成了一个摩擦面,在客户接触人工之前就消磨掉了他们的耐心。客服人员不只是在解决技术问题,他们是在解决技术问题的同时,修复被 AI 破坏的关系。

指标陷阱

会员专享

余下内容仅对会员开放。

会员可读完整内容 —— 每一个公开发布的观点背后,那些框架、决策与推理的全貌。

  • 完整文章,包含未公开存档的部分
  • 可落地的工作框架,附带权衡与决策依据
  • 新文章抢先看,先于公开发布

随时取消 · 一次订阅,畅读全部

参考资料

保持联系,关注我获取更多内容

阅读需 13 分钟

以 Token 数量而非结果驱动的 A/B 测试

当实验平台让统计 Token 数量变得容易而衡量用户结果变得困难时,提示词 A/B 测试往往会发布一些团队无法将其与性能倒退区分开来的局部最优解。

insider
ai-engineering
阅读需 10 分钟

评估员吞吐量是评估流水线中隐藏的瓶颈

在任何重视人工评分的 AI 系统中,评估员的吞吐量都限制了评估速度。本文介绍了一套运营规范——包括校准周期、感知队列的优先级排序以及评分标准反馈循环——旨在将标注产能视为一个 SRE 问题,而非招聘问题。

insider
evals
阅读需 9 分钟

衡量真实的 AI 编程生产力:能在 90 天滞后期中幸存的指标

速度代理指标在第 30 天时看起来非常诱人,但在第 90 天时却与代码质量背道而驰。本文探讨了那些能够揭示 AI 编程工具究竟是在复利生产力,还是仅仅将债务转移到下游的滞后指标与领先信号。

insider
ai-engineering
阅读需 10 分钟

撒谎的"转移率":当 AI 客服的"成功"掩盖了用户流失

转移率统计的是"沉默",而不是"得到帮助"。同一个数字可能意味着客户问题被解决了,也可能意味着客户已经流失—— 仪表盘没法分辨,直到队列报告出来。

insider
ai-support
阅读需 9 分钟

腐烂的黄金数据集:为什么你的评估集会与产品脱节

一个持续通过的黄金评估集可能在对你撒谎。本文探讨评估数据集如何因覆盖范围缺失、标签陈旧和分布偏斜而腐烂,以及如何通过数据卫生保持评分的真实性。

insider
ai-engineering