首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >Self-Ask >Self-Ask 的基本工作原理是什么?

Self-Ask 的基本工作原理是什么?

词条归属:Self-Ask

1. 结构化子问题分解

Self-Ask 通过在提示词末尾插入固定短语"Are follow up questions needed here:"来触发模型的自提问行为。模型首先判断当前信息是否足以直接回答原始问题:若认为需要补充信息,则输出一条或多条以"Follow up:"开头的子问题;每提出一个子问题后,模型随即给出"Intermediate answer:"格式的中间答案,再继续判断是否需要更多追问。当模型认为信息充分时,输出"So the final answer is:"引出最终答案。

2. 与思维链的差异

思维链(Chain-of-Thought, CoT)要求模型输出连续的推理步骤,但步骤之间没有明确的结构边界,本质上是一种自由格式的"内心独白"。Self-Ask 则强制模型将推理过程拆分为结构化的问答对,每个子问题都是独立可验证的信息单元。这种显式分解使得中间结果可以被外部工具(如搜索引擎、数据库查询)替代或校验,而 CoT 的隐式推理步骤难以与工具对接。

3. 组合性差距的缩小机制

该方法的提出源于对"组合性差距"(compositionality gap)现象的观察:大语言模型在多跳问答任务中,往往能正确回答各个子问题,却无法将这些正确答案组合成最终的复合答案。研究表明,随着 GPT-3 系列模型规模增大,单跳问答性能的提升速度远快于多跳问答,这意味着更大的模型只是记住了更多事实,并未真正改善组合推理能力。Self-Ask 通过将组合推理显式化——先拆解、再逐个求解、最后合成——有效缩小了这一差距。

相关文章
基本的爬虫工作原理
爬虫是一种自动化程序,能够模拟人类的浏览行为,从网络上获取数据。爬虫的工作原理主要包括网页请求、数据解析和数据存储等几个步骤。本文将详细介绍爬虫的基本工作原理,帮助读者更好地理解和应用爬虫技术。
用户614136809
2023-10-24
9810
Flink 基本工作原理
Flink是新的stream计算引擎,用java实现。既可以处理stream data也可以处理batch data,可以同时兼顾Spark以及Spark streaming的功能,与Spark不同的是,Flink本质上只有stream的概念,batch被认为是special stream。Flink在运行中主要有三个组件组成,JobClient,JobManager 和 TaskManager。主要工作原理如下图   
actionzhang
2022-11-30
1K0
Spark基本工作原理
Spark的基本工作原理 1、分布式 2、主要基于内存(少数情况基于磁盘) 3、迭代式计算
编程那点事
2023-02-25
3640
Elasticsearch的工作原理是什么?
Elasticsearch是一种流行的分布式搜索引擎,可用于处理大量数据。它使用Lucene搜索引擎库作为其核心组件,可以高效地进行复杂的全文搜索、结构化搜索和分析操作。本文将详细介绍Elasticsearch的工作原理。
网络技术联盟站
2023-06-06
1.3K0
天线的工作原理是什么
天线的工作原理主要基于电磁波的辐射和接收。当天线被放置在电磁波的场中时,天线上的电子会受到电磁波的激励而产生振动。这种振动会产生感应电流,从而在天线上产生一个电压。这个电压可以被进一步处理并转换为电子设备可以使用的电信号。
用户11339509
2024-12-09
1.1K0
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券