发布时间:2026/8/8 0:09:23
开源项目第178期:OptMem — 426 个 token 的提示词,给 AI Agent 跨会话的持久记忆 引言“AI Agent 记性不好不是模型的问题是没有给它一个地方存东西。”这是「每日一个开源项目」系列的第 178 篇。今天的项目是OptMem—— Victor TaelinHigherOrderCO 创始人写的一个极简 AI Agent 持久记忆工具核心是一个 Python 脚本 一段 426-token 的提示词让你的 AI Agent 在会话结束后还能记住上次发生了什么。Claude Code、Codex、Cursor 这类 AI 编程助手有一个共同局限每次新会话都从零开始上次讨论的架构决策、踩过的坑、记住的偏好全部消失。你不得不反复在新会话里解释背景。OptMem 解决的就是这件事给 Agent 一个可持久化的记忆存储让它真的能记住。整个方案的复杂度一个无依赖的 Python 脚本加上把一段提示词粘贴到你的 AGENTS.md 里。1,100 颗 StarVictor Taelin 的个人项目。你会学到什么AI Agent 为什么没有跨会话记忆OptMem 的解法是什么二叉树摘要结构怎么在 O(1) 读取的同时控制 token 消耗memo wake/memo note/memo nap六个命令的工作原理426-token 提示词块里写了什么为什么是 426 个 tokenOptMem 和向量数据库的本质差异适合什么规模的场景在 Claude Code 里的完整配置流程前提知识使用过 Claude Code 或类似的 AI 编程工具了解 AGENTS.md / CLAUDE.md 的概念会基础 Python 环境操作问题背景AI Agent 的健忘症你用 Claude Code 开发一个项目在某次会话里确定了认证方案用 magic link 而不是密码发现了一个特定 API 的速率限制记住了你的测试数据库连接字符串然后会话结束。下次打开 Claude Code它什么都不记得了。你要重新解释上下文重新告诉它那些背景信息有时候还会重复踩同一个坑。这个问题有几种常见的解法方案做法问题CLAUDE.md手动把重要信息写进去需要人工维护容易忘上下文压缩每次会话开始复制上次的内容麻烦不自动化向量数据库语义搜索存储历史需要服务器、嵌入模型复杂OptMemAgent 自己记自动管理—OptMem 的思路让 Agent 自己负责记忆而不是靠人工维护。Agent 在会话开始时加载历史记忆在工作过程中遇到值得保存的信息就自动记录记忆跨会话持久化在本地文件里。核心架构append-only 日志 二叉树摘要OptMem 的所有数据存在~/.optmem/memory/下结构极简~/.optmem/memory/ ├── LOG.txt ← 所有原始记忆每行一条只追加从不修改 ├── TREE/ ← 二叉树摘要节点缓存可从 LOG.txt 完整重建 └── config ← 配置WAKE_LINES 等LOG.txt不可变的事实记录每次memo note 某件事都把一行追加到 LOG.txt 末尾。这个文件从不被修改或删除只追加。固定宽度的记录格式使得每条记忆的位置本身就是它的标识查找是 O(1) 的一次寻址而不是全文扫描。0000000001 | 2026-08-03T10:23:11 | auth flow uses magic links, no passwords 0000000002 | 2026-08-03T10:45:33 | stripe API rate limit is 100 req/min per key 0000000003 | 2026-08-03T11:02:55 | postgres on localhost:5432, dbdev_app ...TREE/二叉树摘要一个缓存随着记忆增多每次 wake 把所有原始记忆都展示给 Agent 会消耗大量 token。OptMem 用二叉树摘要解决这个问题原始记忆 摘要树结构 #0: magic links #0-34条的摘要 #1: stripe rate limit → #0-10和1的摘要 #2: postgres port #2-32和3的摘要 #3: test user email #2-3 ... #0-6364条的摘要 #0-3132条的摘要 #32-6332条的摘要 ...记忆 #0 和 #1 合并为节点#0-1两条的摘要节点#0-1和#2-3合并为节点#0-3四条的摘要以此类推形成二叉树关键点TREE/ 里的所有摘要都是缓存可以从 LOG.txt 完整重建。真正的数据只有 LOG.txt。wake 时展示什么memo wake读取这个树输出一个分层视图## Memory [#0-1023] Summary: Auth uses magic links. Stripe rate 100/min. DB on localhost:5432... [#1024-2047] Summary: Switched to pnpm. Tests run on port 3001. Error handling... ... [#4095] 2026-08-03T14:22:11 | updated homepage hero copy to focus on 10x faster [#4096] 2026-08-03T14:35:44 | user prefers tabs not spaces in this repo [#4097] 2026-08-03T15:01:22 | production deploy requires manual approval step最近的记忆以原始形式展示精确较早的记忆以逐级摘要形式展示压缩。WAKE_LINES配置控制展示多少行默认 96 行约 8k token。六个命令memo wake每次会话开始时运行加载记忆树输出## Memory块供 Agent 读取。memo wake# 输出分层的记忆摘要贴入上下文memo note ...记录一条事实最多 280 字节类 Twitter 设计保持记忆原子性。memo notedecided to use Redis for session storage after testing Postgres was too slowmemo nap处理积累的合并请求——对二叉树节点执行摘要合并。由于没有后台进程压缩任务在 Agent 工作时内联执行。memo recall regex对所有记忆做全文正则搜索。memo recallredis|session# 找到所有提到 redis 或 session 的记忆memo zoom lo-hi展开一个摘要节点看它下面的两个子节点层层向下直到原始记忆。memo zoom0-1023# 展开[0-511] 摘要 和 [512-1023] 摘要memo zoom0-511# 继续展开...memo forget lo-hi删除一个质量差的摘要节点下次nap时从原始记忆重建。426-token 提示词块整个 OptMem 对 Agent 的集成就是把下面这段提示词粘贴到AGENTS.md或CLAUDE.md## Memory You have persistent memory via the memo command at ~/.optmem/memo. **At session start:** run memo wake before any other tool call. **During work:** run memo note ... whenever you learn something worth keeping. - Decisions made, facts discovered, user preferences, pitfalls found - Max 280 chars per note. Be specific. **On compression requests:** answer them before proceeding with other work. **Subagent rule:** if you are a subagent, do NOT run any memo commands. Commands: - memo wake — load memory - memo note ... — record a fact (≤280 chars) - memo nap — process pending merges - memo recall regex — search memories - memo zoom lo-hi — expand a tree node - memo forget lo-hi — drop a bad summary Never directly edit files under ~/.optmem/memory/.这段提示词做了几件重要的事强制顺序wake必须是 Agent 做的第一件事触发时机明确告诉 Agent 什么情况下该记——决策、发现、偏好、坑子 Agent 保护并行子 Agent 不能运行 memo防止重复写入错误不可直接编辑Agent 只通过命令操作记忆不直接写文件安装和配置安装一行命令# macOS / Linuxcurl-fsSLhttps://raw.githubusercontent.com/VictorTaelin/OptMem/main/install.sh|bash# Windows 见 WINDOWS.md安装后memo命令可用数据目录在~/.optmem/。集成到 Claude Code# 1. 运行 memo wake获取提示词块memo wake# 2. 把输出的 ## Memory 块粘贴到你的 AGENTS.md 或 ~/.claude/CLAUDE.md# 3. 之后每次 Claude Code 会话它会自动执行 memo wake 加载记忆配置记忆目录# 把记忆存到 Dropbox/iCloud/git 仓库里跨机器同步exportMEMORY_DIR~/Dropbox/optmem-memoryOptMem vs 向量数据库维度OptMem向量数据库Chroma、Pinecone 等检索方式正则全文搜索语义模糊搜索搭建成本粘贴一段提示词搭建服务器 嵌入模型可检查性纯文本用编辑器直接打开不透明的向量每次会话成本wake 加载固定 token 预算仅查询时消耗百万条记忆速度wake: 0.03 秒取决于服务器语义检索无只有精确词匹配支持适合规模个人 / 单项目企业级大规模OptMem 的核心优势透明度。你可以打开 LOG.txt一行行看 Agent 记住了什么、相不相信它。向量数据库里存的是你读不懂的浮点数。OptMem 的检索局限正则搜索要求精确词匹配。如果记忆写的是登录改用 magic link但你后来问认证方案是什么正则找不到。二叉树摘要部分弥补了这个问题——wake 把摘要加载进上下文模型做语义匹配——但每次会话都需要花固定 token 预算不管用不用到那些旧记忆。适合的场景一个人 一台机器 一个项目的 AI Agent需要记住上周做了什么决定可以打开文本文件看 Agent 记住了什么比检索精度更看重可控性和透明度。项目地址与资源GitHub: VictorTaelin/OptMem作者: Victor TaelinHigherOrderCO 创始人也做 Bend 语言和 HVM 运行时总结OptMem 代表了一种够用就好的工程哲学解决一个真实问题不过度设计。AI Agent 的跨会话记忆是一个实际痛点。向量数据库、RAG 管道、嵌入模型——这些方案技术上更完整但搭建成本和复杂度对个人开发者来说往往是过度工程。OptMem 的方案一个 Python 脚本零依赖追加写文件二叉树做摘要压缩整个集成只需粘贴一段提示词。这个架构做对了一件事LOG.txt 是唯一的真相来源TREE/ 只是缓存。不管摘要质量如何原始记忆永远完整随时可以重建。这让系统在最坏情况下也只是慢一点而不是丢数据。如果你每天用 Claude Code 工作OptMem 能解决的是一个具体的日常痛点。装好之后它在后台静默工作你只需要偶尔留意 Agent 有没有记录重要决策。探索 PrimeSkills —— 精选 AI Agent 与技能的市场每一个都经过真实企业工作流验证去掉浮夸留下真正有用的。欢迎访问我的个人主页发现更多有价值的见解和有趣的产品。

相关新闻

2026/8/8 0:09:23

5分钟掌握CTF流量分析神器:CTF-NetA终极指南

5分钟掌握CTF流量分析神器:CTF-NetA终极指南 【免费下载链接】CTF-NetA CTF-NetA是一款专门针对CTF比赛的网络流量分析工具,可以对常见的网络流量进行分析,快速自动获取flag。 项目地址: https://gitcode.com/gh_mirrors/ct/CTF-NetA …

2026/8/8 0:09:23

企业公章管理怎么做才安全?3 个被忽略的用章漏洞

用章,是企业最容易"出事"的环节 很多中小企业对公章、合同章的管理比较随意:谁急用谁拿,盖完也不登记。等到出问题——比如员工私自盖了份担保协议,老板才发现章早已不在保险柜。用章风险不一定来自恶意,也可…

2026/8/8 0:09:23

Palworld存档迁移终极方案:告别角色丢失的完整指南

Palworld存档迁移终极方案:告别角色丢失的完整指南 【免费下载链接】palworld-host-save-fix Fixes the bug which forces a player to create a new character when they already have a save. Useful for migrating maps from co-op to dedicated servers and fro…

2026/8/8 1:19:33

Unity移动端双指输入优化:解决多点触控冲突的InputSystem实战方案

1. 项目概述:移动端多点触控的“双线作战”难题 在移动端游戏开发里,角色移动和视角转动是两大最核心的交互操作。想象一下,你正用虚拟摇杆控制角色在战场上穿梭,同时需要另一根手指滑动屏幕来环顾四周,观察敌情——这…

2026/8/8 1:19:33

PoC测试实战指南:从概念验证到技术选型的核心方法论

1. 项目概述:PoC测试到底是什么? 在技术选型、产品采购或者方案验证的十字路口,我们常常会听到一个词:PoC测试。无论是销售、售前工程师,还是技术决策者,都把它挂在嘴边。但你真的理解它吗?它是…

2026/8/8 1:19:33

Unity UGUI粒子渲染优化:ParticleEffectForUGUI原理与性能实战

1. 项目概述:为什么UI粒子渲染是个“老大难”?在Unity项目里,尤其是手游和H5小游戏,UI动效是提升用户体验的关键。一个华丽的抽卡闪光、一个流畅的按钮反馈粒子、一个酷炫的全屏庆祝特效,往往能直接决定玩家的第一印象…

2026/8/8 1:19:33

彻底解决Matplotlib中文显示问题:四种方法详解与实战指南

1. 项目概述:为什么matplotlib中文显示是个“老大难”问题?如果你用Python的matplotlib画过图,并且尝试过在图表里添加中文标签、标题,那你大概率踩过这个坑:图表上本该显示中文的地方,变成了一堆方框“□□…

2026/8/8 1:19:33

8051单片机中断系统全解析:从汇编编程到考点精讲

在实际的单片机开发中,中断系统是连接硬件事件与软件响应的核心桥梁。无论是按键触发、定时器溢出,还是串口接收到数据,都需要通过中断机制来确保CPU能够及时响应,而无需持续轮询。对于学习单片机汇编语言的同学而言,中…

2026/8/7 19:43:11

如何用免费工具突破游戏窗口限制:SRWE完整使用指南

如何用免费工具突破游戏窗口限制:SRWE完整使用指南 【免费下载链接】SRWE Simple Runtime Window Editor 项目地址: https://gitcode.com/gh_mirrors/sr/SRWE 你是否遇到过这样的困扰?想为心爱的游戏截图,却发现游戏不支持自定义分辨率…

2026/8/8 0:04:22

Java图像处理实战指南

要执行这些 Java AWT 图像处理程序,你需要将它们分别保存为独立的 .java 文件,并使用 javac 编译,然后使用 java 运行。以下是每个程序的核心执行步骤、依赖关系和要点。 通用执行步骤 保存文件:将每个 listing 的代码复制到文本…

2026/8/8 0:04:23

昇腾AI代理实现多号通话自动化

基于昇腾(Ascend)硬件与AtomGit AI社区的开源生态,结合AI Agent技术,可以实现一个模拟“通话重复使用机号复制”功能的安卓手机应用原型。其核心是利用AI Agent进行意图理解、任务编排和自动化操作,模拟或管理多号码的…

2026/8/8 0:04:23

2026年Graph+AI Agents最新创新思路

本次围绕GraphAI Agents这个方向筛选了15篇高质量论文,都是近年来具有较高引用价值或方法创新的研究工作,其中部分来自IJCAI、AAAI、ICRA。 对于论文er来说,这些论文方法结构清晰、可复现性较强,在多个任务上都有可延展的空间。如…

2026/8/7 9:44:18

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/7 19:03:32

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/6 20:45:01

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…