某中心AI团队在NeurIPS 2021高效自然语言与语音处理研讨会上荣获最佳论文奖。获奖论文《面向任务型对话系统的零样本与少样本知识寻求轮次检测》由应用科学家Di Jin、Shuyang Gao、首席应用科学家Seokhwan Kim、Yang Liu以及高级首席科学家Dilek Hakkani-Tür共同完成。
目前,任务型对话系统通常依赖预定义API完成任务,并将超出API范围的请求过滤为域外案例。该论文重点研究如何通过整合来自网络或其他来源的外部领域知识,更有效地处理域外用户请求。
Di Jin指出,问题主要源于训练数据与实际用户请求之间的分布差异:
研究团队设计了名为REDE的创新模型,该模型通过自适应表示学习和密度估计实现:
Seokhwan Kim解释道:"处理这类问题的典型方法是训练二元分类器(如BERT等大规模预训练语言模型)。但这需要大量正负样本,而开放域对话系统允许用户提出任意问题,难以收集足够数量的域外样本。"
Di Jin补充说明:"我们提出的方法不是基于训练数据集训练分类器,而是通过调整现有表示,将表示转换为具有足够区分能力的新表示,以区分当前API可处理的实例和可能未见的域外实例。"
实验结果显示:
Seokhwan Kim总结道:"关键发现是这种简单的表示转换方法效果显著且高效,将有助于使用更小的数据集和模型开发更强大的对话系统。"
该研究为任务型对话系统的域外请求处理提供了创新解决方案,显著提升了系统的适应性和实用性。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。