上个月我把一大半常见咨询丢给 AI 自动回了:接了知识库做检索,重复问题它直接答,答不了的转人工。前面两周风平浪静,我以为这波提效稳了。
结果一个周末半夜,用户群里炸了——AI 给的回复把人惹毛了,我手机响到凌晨。
我当时的做法
架构不复杂:把历史工单和 FAQ 喂进向量库,检索到相关内容就拼成回复,设了"置信度低于阈值就转人工"的兜底。我特意留了转人工,觉得自己考虑周全。
翻车之后我把那几天所有 AI 回复导出来看,三个坑最致命。
坑一:答非所问,它没听懂人到底在问什么
用户问"我的东西怎么还没到",AI 检索到一条"物流时效说明",回了一大段标准时效。但用户真正问的是"为什么超时了、找谁催"。它给了信息,没解决问题,用户更烦了。知识库检索只能保证"相关",保证不了"答到点上"。
建议先收藏这个判断:自动回复的第一指标不是"答了没",是"答到用户真正的问题没"。后者得靠意图识别,不是向量相似度。
坑二:语气翻车,太机械和太热情都尴尬
我最早用纯检索拼接,回复冷冰冰像机器人念稿,被嫌"有没有活人"。后来我让 AI 润色得口语一点,又过了——有用户问赔偿,它回了句"亲别着急哦~",对方直接炸毛:你跟我套什么近乎。机械显得不尊重,过度热情显得不专业,这条线 AI 自己把握不住。
坑三:幻觉承诺,给了做不到的补偿和时效
最严重的一回。用户问"能不能加急",AI 自己编了句"已为你安排加急,2 小时内处理"。实际根本没这机制。用户真等到 2 小时没动静,跑来骂。这种"好心办坏事"的幻觉承诺,比答不上来伤害大十倍——因为它主动给了错误预期。
我的判断
AI 客服值不值得上?我的结论是:能接住 80% 的重复问,这一点毫无争议;但剩下那 20% 长尾和情绪问题,处理不好就是品牌事故。我现在把"能不能给承诺类回复"单独卡了一道:凡是涉及时效、赔偿、加急,一律屏蔽 AI 自动发,强制转人工。
你们上 AI 客服踩过最大的坑是什么?我是真想听听,因为我现在还不太敢放开长尾那块。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。