首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >GraphRAG >GraphRAG 的索引成本主要由哪些因素决定?

GraphRAG 的索引成本主要由哪些因素决定?

词条归属:GraphRAG

GraphRAG 的索引成本主要来自大语言模型调用,是部署前需要重点规划的部分。

1. LLM 调用是主要成本

  • 索引阶段需对每个文本块调用大语言模型进行实体与关系抽取,还会进行多轮补全抽取
  • 社区摘要生成同样需要大量 LLM 调用,语料规模越大,调用次数越多
  • 因此索引成本与文本块数量、抽取轮数、所用模型的计费标准直接相关

2. 影响成本的关键因素

  • 分块粒度:分块越短,实体召回率越高,但 LLM 调用次数也相应增加
  • 抽取轮数:多轮 gleanings 会提升质量,同时推高调用量
  • 社区层级数量:层级越多,摘要生成的调用量越大

3. 成本控制建议

  • 官方建议先用低成本模型在教程数据集上试跑,评估成本后再投入大规模索引
  • 可通过调整分块策略、抽取轮数与社区层级控制调用规模
  • 后续发布的 LazyGraphRAG 模式大幅降低了索引开销,为成本敏感场景提供了选择
相关文章
75% 成本和时间削减:优化微软 GraphRAG 索引的秘密
书接上回《实战微软新一代RAG:GraphRAG强大的全局理解能力,碾压朴素RAG?》,想必大家都知道我最近在测试GraphRAG,由于其惊人的理解能力,我一直在探索。当然遇到的问题也比较多,比如community_reports不生效,tokens per minute和requests per minute不生效,全局搜索经常JSONDecodeError,以及高昂的成本和时间。这4个问题,我提交了4个PR去修复。本篇将围绕这4个问题和PR说明,最主要的是如何大幅降低成本和时间进行说明,修改很简单,但是精度上升了。
AgenticAI
2025-03-18
1.6K2
深度解析仿人脑记忆搜索的HippoRAG2,全面对比GraphRAG、KAG、LightRAG和PIKE-RAG,成本缩减12倍
持续获取、组织和利用知识的能力是人类智能的关键特征,而 AI 系统若想充分发挥潜力,也必须具备这一能力。近期,一些 RAG 方法通过引入知识图谱等结构来增强对信息的理解和联想能力,部分弥补了这些不足。然而,这些增强方法在基础事实记忆任务上的表现通常远逊于标准 RAG。HippoRAG 2[1] 基于 HippoRAG 采用的 个性化 PageRank(Personalized PageRank, PPR)算法,并进一步优化了信息整合方式,同时增强了 LLM 在在线检索中的作用。
AgenticAI
2025-03-18
3.2K0
2026 RAG 选型指南:Vector、Graph、Vectorless 该怎么挑 
检索找到了某个语义上接近的片段,LLM 围绕它写出一段文字,但是没人发现答案是错的。这是 vector RAG 调参解决不了的失败问题。而现在有2种方法可以解决他:
deephub
2026-05-15
6470
为什么说Youtu-GraphRAG 是图谱检索增强推理智能体的未来?
基于知识图谱的RAG——如何用固定的实体架构在Knowledge Graph上进行RAG检索
山行AI
2026-03-13
4970
GraphRAG实践:企业知识库从文本检索到知识图谱推理的架构升级路径
随着大语言模型(Large Language Model,LLM)进入企业应用阶段,传统知识库面临新的挑战:
网渡科技
2026-07-21
3700
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券