Self-Ask 最有效的抗幻觉机制是将子问题的答案获取权交给外部可信源。当一个子问题被发送至搜索引擎或企业知识库时,返回的是客观存在的文档片段而非模型生成的文本,这从根本上切断了幻觉的产生路径。实验表明,Self-Ask 配合搜索引擎后,在 Bamboogle 数据集上的准确率从 57.6% 进一步提升至 60.0%。
每个中间答案都有明确的来源标记——无论是来自模型内部知识还是外部工具——这使得最终答案的每个组成部分都可以被追溯到具体的证据。在金融、法律、医疗等高风险领域,这种可追溯性比单纯的准确率数字更为重要,因为它允许人类专家对推理过程进行逐段审核。
Self-Ask 主要针对事实性幻觉(编造不存在的事实)有效,对逻辑幻觉(推理过程中的谬误)和语义幻觉(曲解用户意图)的抑制作用较弱。此外,如果外部工具本身返回了错误信息(如搜索引擎返回了不相关的页面),Self-Ask 无法自动识别这类"工具侧幻觉",仍需配合人工审核或多源交叉验证机制。