社会的拿破仑
为什么普通 ASR 到了多人会议场景,准确率往往会明显下降?
原创
关注作者
腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
社会的拿破仑
社区首页
>
专栏
>
为什么普通 ASR 到了多人会议场景,准确率往往会明显下降?
为什么普通 ASR 到了多人会议场景,准确率往往会明显下降?
社会的拿破仑
关注
发布于 2026-09-04 15:01:43
发布于 2026-09-04 15:01:43
38
0
举报
概述
为什么普通 ASR 到了多人会议场景,准确率往往会明显下降?
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系
cloudcommunity@tencent.com
删除。
语音识别
人工智能
智能硬件 AI 语音助手
目录
一、会议场景首先改变的是 ASR 的输入条件
二、多人会议真正增加了一个问题:谁在说话
三、重叠语音是多人会议里最难处理的情况之一
四、很多转写错误,其实发生在 ASR 之前
五、会议中的专有词,也会放大错误
六、为什么会议转写不能只看 CER 或 WER
七、真正可用的会议转写,本质上是一条完整 Pipeline
问题归档
专栏文章
快讯文章归档
关键词归档
开发者手册归档
开发者手册 Section 归档