首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >Agentic RAG >Agentic RAG 的查询改写与分解是如何提升检索效果的?

Agentic RAG 的查询改写与分解是如何提升检索效果的?

词条归属:Agentic RAG

1. 查询改写的核心方法

用户查询往往过于简短、口语化或使用知识库中不存在的实体名称,直接用于检索效果不佳。查询改写的主要方法包括:

  • 查询扩展:添加同义词、上下位词和相关实体,扩大召回范围
  • 查询重写:将自然语言查询改写为更适合向量检索或关键词检索的形式
  • HyDE(假设性文档嵌入):先由模型生成一个假设性答案,用该答案的嵌入向量进行检索,绕过查询与文档之间的措辞差异
  • 实体消歧:识别查询中的歧义实体并明确指向

2. 查询分解的策略

对于包含多个信息需求的复合查询,智能体将其分解为多个原子子查询:

  • 并行分解:将独立的信息需求拆分为可并行执行的子查询
  • 串行分解:将存在依赖关系的子问题按顺序排列,前一步结果指导后续查询
  • 条件分解:根据中间结果动态决定后续子查询的内容

3. 效果提升数据

查询改写与分解对检索效果的提升有实证支撑:

  • 在多跳问答基准上,查询改写可带来数个百分点到数十个百分点的召回率提升
  • 查询分解使复杂问题的回答完整度显著提高,因为每个子问题都能获得针对性的检索
  • 代价是每轮改写和分解需要额外的 LLM 调用,增加延迟和 Token 消耗
相关文章
查询分解是提高LLM检索效率的关键,别只依赖简单改写!
论文题目:A Survey of Query Optimization in Large Language Models
AI研思录
2025-02-20
5930
如何引入重排序提升RAG系统的效果?
之前介绍了在RAG系统中使用混合检索,而混合检索将不同的检索技术的优势,如向量检索适合语义模型匹配,而关键词检索适合精准匹配。将不同的优势结合互补单一检索的劣势,获得更好的召回结果。----
产品言语
2024-03-18
1.7K0
一文讲清如何做好Workflow、RAG、Agent、Agentic RAG的技术选型!干货满满,不要错过
上周我们强调了Workflow的重要性,私下又有很多粉丝找过来,一定让我聊聊Workflow、RAG与Agent之间的关系,这一下就把我难住了,一个是这东西有撒好解释的?另一方面他们之间貌似没什么绝对的关系...
烟雨平生
2026-04-14
1.1K0
怎么知道效果提升了?7个用于改进RAG系统的检索指标
大型语言模型(LLM)是一种生成式人工智能技术,在过去两年中获得了极大的关注。然而,当我们将LLM应用于实际场景时,仍然面临知识局限性和“幻觉”问题。检索增强生成(RAG)通过为LLM提供额外的记忆和上下文来解决这些问题。在2024年,RAG已成为应用生成式AI领域最受欢迎的技术之一。事实上,可以假设任何基于LLM的应用程序都以某种方式使用了RAG。
致Great
2025-02-17
2.7K0
用 WorkBuddy 落地生产级 RAG:混合检索 + 重排序 + 查询改写的完整工作流
RAG(检索增强生成)是当下最落地的 AI 应用形态——让大模型先查资料再回答,从根本上减少胡说。但「Demo 级 RAG」和「生产级 RAG」之间隔着一条鸿沟:Demo 用向量相似度搜一下就完事,真实业务里用户问得含糊、文档长得离谱、答案要精确到条款。本文用 WorkBuddy 作为编排端与智能预处理层,系统性拆解把 RAG 从「能跑」做到「好用」的三板斧——混合检索、重排序、查询改写,并补充评测方法、成本延迟权衡、部署架构与完整提示词模板。读完你能搭出一个检索准、答得稳、敢上生产的 RAG 系统,而不是又一个只能跑 hello world 的玩具。
正直的数据官小瓦
2026-09-18
1230
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券