发布时间:2026/8/24 10:35:52
RAG架构进阶:从基础检索到GraphRAG RAG架构进阶从基础检索到GraphRAG检索增强生成RAG已成为大语言模型解决知识时效性和领域适配问题的标准方案。但基础RAG向量检索提示拼接在面对复杂查询时暴露出明显短板无法捕捉实体关系、缺乏全局推理能力。GraphRAG的出现标志着RAG架构从语义匹配向结构理解的范式升级。本文将系统梳理RAG的技术演进并深入解析GraphRAG的实现原理。一、基础RAG的架构与局限1.1 标准RAG流水线from langchain.vectorstores import Chroma from langchain.embeddings import OpenAIEmbeddings class BasicRAG: def __init__(self, documents): self.embeddings OpenAIEmbeddings() self.vectorstore Chroma.from_documents( documents, self.embeddings ) self.llm ChatOpenAI() def query(self, question: str, k: int 3) - str: # 1. 向量检索Top-K相关文档 relevant_docs self.vectorstore.similarity_search(question, kk) # 2. 拼接上下文 context \n\n.join([doc.page_content for doc in relevant_docs]) # 3. LLM生成答案 prompt f基于以下上下文回答问题\n\n{context}\n\n问题{question} return self.llm.predict(prompt)1.2 基础RAG的固有缺陷| 问题类型 | 具体表现 | 根因 | |----------|----------|------| | 语义鸿沟 | 检索到表面相关但实质无关的文档 | 向量相似度≠语义相关性 | | 关系盲区 | 无法回答A和B有什么关系 | 丢失实体间关联信息 | | 全局缺失 | 无法回答总结全文档的主题分布 | 分段检索缺乏全局视图 | | 多跳推理 | 需要跨多个文档串联信息 | 单次检索无法覆盖推理链 |二、RAG增强策略从局部到全局2.1 多路召回与重排序class MultiWayRAG: def __init__(self): self.keyword_store BM25Retriever() # 关键词检索 self.vector_store Chroma() # 向量检索 self.reranker CrossEncoder(cross-encoder/ms-marco-MiniLM-L-6-v2) def retrieve(self, query, k10): # 多路召回 keyword_results self.keyword_store.retrieve(query, kk*2) vector_results self.vector_store.similarity_search(query, kk*2) # 合并去重 candidates self.deduplicate(keyword_results vector_results) # 重排序 pairs [(query, doc.page_content) for doc in candidates] scores self.reranker.predict(pairs) # 返回Top-K return [candidates[i] for i in np.argsort(scores)[-k:]]2.2 查询重写与多步检索class MultiStepRAG: def query(self, question): # 第一步分解查询 sub_queries self.decompose(question) # 第二步逐个子查询检索 all_evidence [] for sq in sub_queries: docs self.retrieve(sq) all_evidence.extend(docs) # 第三步基于证据链推理 answer self.reason(question, all_evidence) return answer def decompose(self, question): prompt f将复杂问题分解为2-3个子问题{question}\n输出JSON数组 return json.loads(self.llm.predict(prompt))三、GraphRAG知识图谱驱动的RAGGraphRAG由微软研究院提出核心思想是在检索阶段引入知识图谱的拓扑结构实现全局推理和关系感知。3.1 GraphRAG索引构建流程class GraphRAGIndexer: def __init__(self, llm): self.l

相关新闻

2026/8/24 9:15:42

芯片dft覆盖率

ATPGDC-SCAN覆盖率分类体系DC-Scan 的覆盖率指标ATPG 的覆盖率指标核心关系:DC-Scan 是 ATPG 的前提完整覆盖率计算流程Step 1: DC-Scan 阶段(结构验证):Step 2:ATPG 阶段(TetraMAX)Step 3: 综合覆盖率报告…

2026/8/24 4:09:20

蓝奏云直链解析终极指南:3分钟获取稳定下载地址

蓝奏云直链解析终极指南:3分钟获取稳定下载地址 【免费下载链接】LanzouAPI 蓝奏云直链,蓝奏api,蓝奏解析,蓝奏云解析API,蓝奏云带密码解析 项目地址: https://gitcode.com/gh_mirrors/la/LanzouAPI 还在为蓝奏…

2026/8/24 18:29:54

看完这篇,你就知道为什么Vue、React都偏爱函数表达式了!

大家好,我是31岁的小米,上周,一个准备跳槽的小伙伴找到我,他说:"小米,我昨天面试的时候,面试官问了一个特别奇怪的问题。" 我问:"什么问题?" 他说:"JavaScript里面,函数声明和函数表达式有什么区别?" 他说自己当时回答:"一个是…

2026/8/24 20:23:14

开源桌面宠物dsh-pet v0.3:零门槛部署与Python二次开发指南

这次我们来看一个开源桌面宠物项目——鲸鱼娘校宠 dsh-pet v0.3。它不是一个复杂的AI模型,而是一个用Python写的、会动会叫的桌面小精灵,核心目标就是“陪伴”:在你工作或学习时,它会在屏幕角落游来游去,偶尔互动&…

2026/8/24 20:23:14

智能制造转型实战:从概念到落地的核心能力与实施路径

1. 先看懂“智造之城”到底在解决什么实际问题“智造之城”不是一个简单的口号,它背后要解决的是所有工业城市发展到一定阶段后都会遇到的瓶颈问题:如何在土地、劳动力等传统要素成本持续上升的背景下,继续保持甚至提升工业的竞争力、利润率和…

2026/8/24 20:23:14

【数据结构】排序算法:归并排序与基数排序

考点频率:★★★★☆(选择题常考,归并排序的复杂度与稳定性是重点,基数排序常考其适用场景) 难度:⭐⭐⭐⭐(归并排序需理解分治与合并,基数排序需理解分配与收集过程) 建…

2026/8/24 20:23:14

Aurora IDE 测试版 1.0 深度体验:从安装配置到 Web 项目实战全指南

最近在尝试新的开发工具时,发现了一款名为 Aurora IDE 的集成开发环境,它目前处于测试版 1.0 阶段。对于开发者而言,一个顺手的 IDE 能极大提升编码效率和幸福感。本文将基于 Aurora IDE 测试版 1.0,为大家带来一份从零开始的深…

2026/8/24 20:18:13

Czkawka:一款开源工具找出重复文件、相似图片与空文件夹

Czkawka:一款开源工具找出重复文件、相似图片与空文件夹 【免费下载链接】czkawka Multi functional app to find duplicates, empty folders, similar images etc. 项目地址: https://gitcode.com/GitHub_Trending/cz/czkawka Czkawka 是一款用 Rust 编写的…

2026/8/24 0:07:22

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/24 1:12:32

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/24 8:17:29

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/24 1:09:25

3条命令跑通LocalAI:无GPU本地AI引擎部署

3条命令跑通LocalAI:无GPU本地AI引擎部署 【免费下载链接】LocalAI LocalAI is the open-source AI engine. Run any model - LLMs, vision, voice, image, video - on any hardware. No GPU required. 项目地址: https://gitcode.com/GitHub_Trending/lo/LocalAI…

2026/8/24 1:09:25

AI推理性能测试怎么做:MLPerf Inference完整上手指南

AI推理性能测试怎么做:MLPerf Inference完整上手指南 【免费下载链接】inference Reference implementations of MLPerf inference benchmarks 项目地址: https://gitcode.com/gh_mirrors/inf/inference 同一个模型换一张卡,速度快多少你知道吗&a…

2026/8/24 13:42:17

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/24 18:13:48

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/23 4:22:01

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…