发布时间:2026/8/25 9:45:27
LongtermChatExternalSources记忆原理揭秘:Embedding向量化与余弦相似度检索的完整拆解 LongtermChatExternalSources记忆原理揭秘Embedding向量化与余弦相似度检索的完整拆解【免费下载链接】LongtermChatExternalSourcesGPT-3 chatbot with long-term memory and external sources项目地址: https://gitcode.com/gh_mirrors/lo/LongtermChatExternalSourcesLongtermChatExternalSources 是一个开源的GPT-3 长期记忆聊天机器人核心能力正是 Embedding 向量化与余弦相似度检索。这篇教程带你逐行看懂 chat.py 的记忆实现10 分钟搞懂 AI 聊天机器人记住过去的完整原理。为什么聊天机器人需要长期记忆默认的 GPT-3 API 是无状态的——每次请求都是全新的聊完即忘。这个项目用一套纯文件 向量的方案解决记忆问题架构非常轻量目录角色类比nexus/每条对话的消息 向量情景记忆海马体internal_notes/GPT-3 生成的记忆摘要陈述记忆压缩笔记gpt3_logs/每次调用的提示词与输出调试日志 一句话概括每条消息都变成一个高维向量存盘提问时再靠向量夹角找出最相关的旧记忆。Embedding 向量化把文字变成 1536 维向量记忆的入口在 gpt3_embedding 函数def gpt3_embedding(content, enginetext-embedding-ada-002): content content.encode(encodingASCII,errorsignore).decode() response openai.Embedding.create(inputcontent,engineengine) vector response[data][0][embedding] # this is a normal list return vector关键点调用 OpenAI 的text-embedding-ada-002模型将任意文本编码为1536 维浮点向量发送前先用 ASCII 编码过滤掉非英文字符errorsignore兼容当时 API 的限制向量的魔法在于语义越相近的两段文字向量方向越接近可以直接翻一下真实数据感受 nexus/log_1674383041.28684_USER.json一句good morning raven就对应一个包含 speaker、时间戳、uuid 和上千行向量的 JSON 文件。余弦相似度找出意思相近的记忆拿到查询向量后如何判断哪条旧记忆最相关答案在 similarity 函数def similarity(v1, v2): return np.dot(v1, v2)/(norm(v1)*norm(v2)) # return cosine similarity这就是教科书级的余弦相似度公式cos θ 点积 / (模长 × 模长)。结果范围是 -1 ~ 1越接近 1 表示两条记忆方向越一致越相关只比较方向、忽略长度因此早上好和清晨问候能被判为高相似而不受句子长短影响检索逻辑在 fetch_memories 函数 中遍历nexus/全部历史消息逐条打分、排序跳过与当前消息完全相同的向量最后返回Top 10条最相关记忆。完整检索链路AI 想起过去的 6 个步骤主循环 chat.py 第 141-172 行 把上面的零件串成流水线每一轮对话都执行用户输入 → 向量化gpt3_embedding(a)连同 uuid、时间戳存为nexus/log_时间戳_USER.json载入全部历史load_convo 按时间正序读取nexus/下所有 JSON检索情景记忆fetch_memories(vector, conversation, 10)取余弦相似度最高的 10 条摘要压缩summarize_memories 把 10 条记忆拼成文本块用 prompt_notes.txt 让 GPT-3 写成-开头的笔记列表再为笔记块本身生成向量存入internal_notes/组装提示词prompt_response.txt 中NOTES和CONVERSATION两个占位符分别填入摘要笔记和最近 4 条消息生成并存档回复text-davinci-003输出答案回复同样向量化后存回nexus/完成一轮闭环流程图直观版用户输入 ──▶ Embedding 向量化 ──▶ 余弦相似度检索 Top10 记忆 ▲ │ │ ▼ 回复存档 ◀── GPT-3 生成 ◀── 摘要笔记 最近4条消息用真实数据验证记忆效果打开 internal_notes/notes_1674383045.5926764.json能看到 GPT-3 实际压缩出的记忆笔记User: Asked about difficulty sleepingRaven: Suggested establishing a regular sleep schedule…User: Asked about the singularityRaven: Explained the concept of the singularity…8 条原始对话被浓缩成 8 行要点uuids/times字段保留了可回溯的溯源链。此外dream_sequence.py 是作者预留的梦境模块复用了同一套向量化与相似度能力用于离线提炼用户偏好原则提示词见 prompt_dream_user.txt属于项目规划中的扩展方向。快速上手5 步跑通你的记忆型 GPT-3 聊天机器人按照 README.md 的说明操作克隆仓库git clone https://gitcode.com/gh_mirrors/lo/LongtermChatExternalSources创建虚拟环境python3 -m venv env并激活安装依赖pip install openai numpy将 OpenAI API Key 写入项目根目录的openaiapikey.txt末尾不要换行运行python chat.py即可在命令行与有记忆的 RAVEN 对话常见问题Q1为什么不用向量数据库而是逐文件遍历消息量小时暴力扫描足够且架构零依赖、完全透明代码里的 TODO 注释也表明后续计划引入时间邻近召回等优化见 chat.py 第 58 行。Q2记忆会无限膨胀吗每条消息一个 JSON 文件笔记是增量摘要而非全量重算配合uuid索引便于后续去重与归档。Q3换成中文能用吗当前errorsignore会丢弃非 ASCII 字符直接输入中文会被清空改造该过滤逻辑即可支持这也是动手练习的好切入点。总结LongtermChatExternalSources 用不到 200 行代码演示了 RAG 时代记忆系统的雏形——向量化存记忆、余弦相似度找记忆、大模型压缩记忆。吃透 chat.py 后你就能为任何无状态大模型应用挂上长期记忆。【免费下载链接】LongtermChatExternalSourcesGPT-3 chatbot with long-term memory and external sources项目地址: https://gitcode.com/gh_mirrors/lo/LongtermChatExternalSources创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2026/8/25 9:45:27

AI工程师面试核心考点与实战解析

1. AI工程师面试全景解析最近两年AI工程师岗位的竞争激烈程度远超想象,去年某大厂校招岗位报录比达到惊人的300:1。作为面试过上百名候选人的技术面试官,我整理了这份覆盖算法、工程、业务三大维度的题库,并附上评分标准和避坑指南。AI面试与…

2026/8/25 9:45:27

ESP-IDF安装避坑指南:系统兼容、Python隔离与离线部署

1. 为什么ESP-IDF安装成了多数人卡住的第一道墙? 我带过二十多个嵌入式新人项目,几乎每个人在“点亮LED”之前,都先被ESP-IDF安装绊倒过。不是代码写错了,而是环境根本没跑起来——终端报错 command not found: idf.py 、VS Co…

2026/8/25 12:01:06

LangChain:ChatModel 聊天模型与可配置模拟器

目录 一、什么是聊天模型 1.1 什么是消息 1.2 模型的分类 1.2.1 真实聊天模型 1.2.2 可配置模拟器模型 1.3 与LLM的区别 1.4 注意事项 二、通过API来定义聊天模型 2.1 ChatDeepSeek 2.2 init_chat_model 2.2.1 函数定义 2.2.2 实例1:创建无配置模型 2.…

2026/8/25 12:01:06

从简历到技术面,Java面试考察的关键能力

一份简历躺在邮箱里七秒,决定它命运的不是学历栏,而是技术栈后面那行不起眼的“熟悉XXX”。绝大多数Java候选人死在第一关,不是技术不够,而是简历上的每一个关键词都在替面试官划好考点,而你自己根本没意识到。从简历初…

2026/8/25 11:56:06

后端开发入门:先搞懂这些核心概念再说

你第一次写后端接口时,可能以为后端就是接收请求、查数据库、返回JSON。等你真正踏入生产环境,才发现这套想象只覆盖了冰山一角。后端开发入门最大的误区,就是先学框架和语法,而不是先理解那些与语言无关的核心概念。后端是一门关…

2026/8/25 1:04:19

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/25 11:48:27

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/24 8:17:29

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/25 0:04:14

三步把QQ空间历史说说导出到本地:GetQzonehistory 极简指南

三步把QQ空间历史说说导出到本地:GetQzonehistory 极简指南 【免费下载链接】GetQzonehistory 获取QQ空间发布的历史说说 项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory Meta Description:GetQzonehistory 是一个QQ空间历史说…

2026/8/25 0:04:14

洛谷 P7912:[CSP-J 2021 T4] 小熊的果篮 ← 双向链表

【题目来源】 https://www.luogu.com.cn/problem/P7912 【题目描述】 小熊的水果店里摆放着一排 n 个水果。每个水果只可能是苹果或桔子,从左到右依次用正整数 1,2,…,n 编号。连续排在一起的同一种水果称为一个“块”。小熊要把这一排水果挑到若干个果篮里&#x…

2026/8/24 13:42:17

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/24 18:13:48

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/25 1:08:14

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…