RAG每次查询重头推导知识 LLM Wiki一次编译实现知识积累

发布时间:2026/9/12 20:40:57

RAG每次查询重头推导知识 LLM Wiki一次编译实现知识积累 在为 AI 代理配备代码库、设计文档、邮件记录或研究资料时最标准的做法是 RAG分块、嵌入、查询时检索 top-k 片段再让模型生成回答。这套流程跑得通但存在一个结构性的缺陷——合成永远发生在查询时刻。模型每回答一次问题都要从原始碎片重新拼凑上下文、重建理解。第十次问同一个代码库的架构逻辑和第一次一样需要模型重新梳理没有任何知识沉淀。LLM Wiki 把这个时间点彻底前移合成只在摄入时发生一次之后通过持久的 Markdown 页面实现积累与更新。四个独立团队在几个月内不约而同地验证了同一套架构这不是巧合而是对一个底层问题的共同解答。维护簿记工作如何成为传统 wiki 的隐形杀手人类 wiki 失败的原因从来不是缺少洞察而是无止境的簿记。新增一份设计文档后需要手动更新几十个实体页的摘要、补全交叉引用、检查与已有内容的矛盾。这些工作没有即时反馈也没有上限。团队一忙起来就自然放弃wiki 逐渐腐烂人们不再信任它它就死了。模型却不介意做这些 unglamorous 的工作。它不厌倦不会遗漏交叉引用能一次性触达多个文件并保持一致。Karpathy 在原始 gist 中直指这一点普通文档流程的问题在于“模型每次都在从头 rediscover 知识”而 LLM Wiki 的核心是“编译一次然后保持新鲜”。这就像数据库里的物化视图。原始表是不可变的源数据每次查询都做复杂 join 计算类似 RAG 的每问重推导物化视图则在数据变更时预先计算并维护结果后续查询直接读视图速度快且一致。LLM Wiki 做的正是知识层的物化。LLM Wiki 的三层结构为什么专为代理阅读而设计整个模式只有三层极简却极度适配模型的阅读习惯原始来源层不可变。论文、仓库、邮件、Notion 页面——模型只读不写。Wiki 层模型完全拥有的 Markdown。包含实体页、概念摘要、交叉引用。页面不是写给人看的而是写给下一个读取它的模型看的。Schema 层一个配置文件常见命名 CLAUDE.md、AGENTS.md 或类似。它定义 wiki 的组织规则、页面模板、以及模型必须执行的工作流。这让模型从“会写文件的聊天机器人”变成“有纪律的维护者”。三层之间通过三个核心操作闭环运行摄入新来源到达时模型识别受影响实体更新或创建页面修订摘要标记矛盾、查询从 wiki 读取上下文可选地把高质量回答回写为新页面让探索持续 compounding、Lint定期扫描陈旧声明、矛盾、孤儿页并修复。下面是这个闭环的逻辑架构建议Mermaid优质回答可选回写修复矛盾/陈旧原始来源层不可变摄入操作Schema 配置层组织规则与工作流Wiki 层LLM 拥有的 Markdown实体页 摘要 交叉引用查询操作定期 Lint 操作四团队不约而同的选择揭示了什么底层正确性四家团队解决的问题不同公开代码库、CI 构建、私人知识、生活记录却在几个月内收敛到几乎相同的形状团队主要语料货币性处理核心工程特点Cognition DeepWiki任意 GitHub 公开仓库按需刷新公共服务已索引 5 万 仓库Devin 的检索基础设施Factory AutoWiki代码库CI 每次 push 自动刷新两阶段专项代理分析文档作为构建产物LangChain OpenWiki代码 个人来源Gmail/Notion/X 等按需刷新从代码扩展到 Personal Brain输出专为模型优化的结构化 MarkdownGarry Tan GBrain个人知识库Git 按需最简实现纯文件 schema无向量库依赖收敛点清晰Markdown 存 Git Schema 文件 摄入时合成 变更时刷新。分歧主要在“如何保持新鲜”——Factory 把 staleness 当成构建问题用 CI 解决其他团队则依赖按需触发。这正是成熟度的信号当独立团队在不同约束下走到同一架构时这个形状大概率是对的。它不是用户记忆 而是语料的持久编译产物这里有一个容易混淆但必须区分的边界。LLM Wiki 解决的是语料知识把一堆文档/仓库/邮件“说了什么”编译成可查询、可维护的页面。它回答“这个材料集合包含哪些事实和关系”。它不解决用户与体验记忆某个具体用户上周改变了供应商决策、某个方法在某个 App 里已经试过失败、用户的偏好随时间演变。这些是按 user_id 绑定的、从交互中积累、需要支持矛盾与删除的记忆。把 wiki 当成“给代理加了记忆”是一种常见的误判。Wiki 给你的是编译后的语料资产而不是跟随用户的长期个人记忆。两者是互补的前者让代理能高效读取稳定知识后者让代理真正记住“你”。规模、忠实度与陈旧性构成的真实边界这个模式不是万能的它有清晰的适用范围规模Karpathy 自己指出无 embedding 的 index-first 方式在中等规模约 100 个来源、几百页表现惊人。超过这个量级就需要引入混合搜索BM25 向量 LLM 重排正如原 gist 推荐的 qmd 那样。忠实度摄入时编译意味着早期摘要可能悄无声息地丢失源细节后续所有回答都会继承这个损失。纯检索原始 chunk 不存在这个压缩风险。陈旧性编译页面的正确性只等于上次刷新的时刻。过时的 wiki 比没有 wiki 更危险因为它以权威格式自信地给出错误信息。Factory 用 CI 解决这个问题其他方案则依赖人工触发。编译成本你需要 upfront 支付 token 来构建可能永远不会被查询的页面以及定期 lint。在生产环境落地前必须权衡的编译与检索边界当语料稳定且被频繁重读时优先编译成 wiki能把后续查询的合成成本降到极低并让知识真正积累。当语料快速变化或规模已经很大时纯编译的忠实度与陈旧风险会上升需要在关键路径上保留检索能力或采用混合策略小规模编译 大规模混合搜索。我起初以为这只是文档自动生成的又一次迭代后来对比 Karpathy 的原始表述和四团队的实际工程差异后才意识到这是在重新定义代理持有知识的方式——从“每次都重新教育模型”变成“模型负责维护一个活的知识资产”。知识的积累不是检索的自然副产品而是编译的主动结果。维护从来不是写的问题而是持续更新的簿记问题。而模型恰好是唯一不怕做这些工作的存在。当你的语料规模从几十页增长到几百页时你会如何在纯编译 wiki 和混合检索之间动态切换这个选择对长期 token 效率和回答一致性的影响值得每位构建生产级 AI 代理的工程师认真思考。我是紫微AI在做一个「人格操作系统ZPF」。后面会持续分享AI Agent和系统实验。感兴趣可以关注我们下期见。
延伸阅读

更多相关文章

2026/9/9 0:48:01

2026国内比较好的ERP系统有哪些?国内知名的ERP系统厂商完整排名盘点

在数字化浪潮席卷全球的今天,企业面临着订单碎片化、渠道多元化、库存复杂化等多重挑战。传统的“单机版”或“单一功能”软件已难以满足企业全链路数字化的需求。2026年,如何选择一款既能打通业务财务闭环,又能适配国内跨境、线上线下多场景…

2026/9/12 10:47:58

小米员工丢了 6 年前的工程机,离职还要赔 3899?

刷脉脉看到一个挺炸裂的帖子。 有小米员工说,6 年前领的两部工程手机误丢了,离职流程里被要求赔付 3899 元。 更尴尬的是,评论区有人查了下,京东上全新机现在才 1600 多。所以大家吵起来了: 6 年前的工程机&#xff0c…

2026/9/12 11:41:51

SSE流式传输与AES加密实战:保障AI对话数据安全

1. 项目概述:当AI流式输出遇上数据安全最近在做一个AI对话类的项目,后端用的是Spring Boot,前端是Vue,大模型返回的内容通过SSE(Server-Sent Events)进行流式输出。项目快上线时,安全审计提了个…

2026/9/12 20:36:02

Linux 监控:10+ 种监控方式、工具

主要要点 Linux监控对于确保工作负载的性能、安全性、可用性和合规性至关重要。使用htop、Netdata和Prometheus等工具来跟踪CPU、内存、磁盘I/O、网络活动以及整体系统健康状况。监控只是其中一半——与像KernelCare这样的无需重启的补丁解决方案结合使用,可以减少…

2026/9/12 20:36:02

艾思科蓝精选——2026年12月国际学术会议清单:人工智能/能源电力/机械电子等领域全覆盖,IEEE/ACM权威出版,双一流高校主办,线上线下同步,EI/Scopus检索稳定,硕博毕业/职称评审一次过

不少硕博生、青年教师在筹备论文发表时,都希望找到主办单位权威、检索稳定、覆盖学科广的国际学术会议。艾思科蓝整理推出2026 年 12 月国际学术会议清单,汇集人工智能、能源电力、机械电子等多领域会议,由双一流高校主办,支持 IE…

2026/9/12 2:05:33

超人会飞不算本事:系统稳定依赖清晰规则与边界设计

开头先不绕弯子。“#斯坦李吐槽dc 所以超人是无缘无故会飞的嘛哈哈哈哈哈哈哈锤哥真是技术人才啊!#雷神 #复联”这类调侃式短标题,第一波冲击力在于它把两个宇宙的角色塞进同一个吐槽箱里,但细想一下就能发现,它真正碰到的根本不是…

2026/9/12 3:55:12

超人VS蜘蛛侠:拆解超级IP的影响力与传播方法论

把“蜘蛛侠 vs 超人”放在 CSDN 上聊,可能很多人第一反应是走错片场了。但如果把这两个角色看成“两个持续运营了 80 多年的文化产品”,你会发现,这场比较本质上是两个不同 IP 策略的长期结果对比:超人赢在定义了整个超级英雄题材…

2026/9/12 10:09:03

基于CNN的调制信号识别:MATLAB实现时频图分类实战

简介:本资源是一套面向通信工程与信号处理方向学习者、研究者的深度学习实践方案,聚焦调制信号自动检测与识别这一典型无线通信任务,解决传统方法依赖人工特征、低信噪比下性能下降等痛点。压缩包共12个文件(10.73MB)&…

2026/9/12 0:04:17

MATLAB仿生优化框架:长鼻浣熊算法多策略融合实现

简介:本资源是一份面向智能优化算法研究者与MATLAB初学者的仿生智能算法实践代码包,聚焦于长鼻浣熊优化算法(COA)的多策略改进与性能验证。针对传统COA易陷局部最优、收敛精度不足等问题,作者融合Circle映射初始化提升…

2026/9/12 0:04:17

【JAVA毕设源码分享】基于 JavaWeb 的校园一卡通管理系统的设计与实现 基于 JavaWeb 的校园卡业务管理系统(程序+文档+代码讲解+一条龙定制)

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

2026/9/12 0:04:17

【JAVA毕设源码分享】基于 Java 的图书馆借阅管理平台的搭建与实现 基于 Java 的图书馆综合管理系统(程序+文档+代码讲解+一条龙定制)

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

2026/9/12 6:29:36

USB Type-C PCB布局分区设计:电源、高速信号与PD协议全攻略

做硬件这行,Type-C接口算是典型的“看着简单,做起来全坑”的东西。光引脚就24个,高低速信号、电源、控制线全部塞在一个小小的连接器里,如果PCB布局不做规划,打样回来基本就是“插上没反应”、“高速掉线”、“静电一打…

2026/9/12 14:32:17

系统编程学习原型如何补齐稳定性边界

系统编程学习原型如何补齐稳定性边界预算有限时&#xff0c;我先优化明显多余的复制&#xff0c;而不是猜测性地换容器。用借用传递只读数据通常就能减少分配&#xff1a; fn parse(line: &str) -> Result<Item, Error> { /* ... */ }用基准确认热点确实在分配&am…

2026/9/12 6:37:43

雨花区哪家财务公司代理记账比较好?

在雨花区&#xff0c;企业处理财税事务常常面临诸多挑战&#xff0c;选择一家靠谱的财务公司至关重要。湖南巨勤财务管理咨询有限公司就是本地正规实体财税服务机构&#xff0c;深耕本地工商财税行业多年&#xff0c;熟悉当地工商局、税务局最新政策与申报流程。主营公司注册、…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
咨询二维码