发布时间:2026/8/26 20:20:56
SpringAI集成RAG实操(postgresql+pgvector)中(集成到项目中) 1、在pom.xml 引入依赖!-- 自动整合 PGVector 向量存储 --dependencygroupIdorg.springframework.ai/groupIdartifactIdspring-ai-starter-vector-store-pgvector/artifactIdversion1.0.0-M7/version/dependency2、application.yml 加入pgvector配置spring:ai:dashscope:# 需要替换为你自己的 keyapi-key:你的API-Keyembedding:options:model:qwen3.7-text-embeddingdimensions:1024################################################################# postgresql 向量数据库配置 ###################################################################vectorstore:pgvector:initialize-schema:true# 会自定初始化向量数据表 vector_storeindex-type:HNSW# 量索引的类型为 HNSW分层可导航小世界图。dimensions:1024# 存储的向量维度为 1024。distance-type:COSINE_DISTANCE# 相似度度量方式为“余弦距离max-document-batch-size:10000# Optional: Maximum number of documents per batchid-type:uuidtable-name:vector_store# 向量数据表表名schema-name:publicdatasource:url:jdbc:postgresql://localhost:5432/postgresusername:postgrespassword:123456项目启动时会自动创建向量数据表表名为vector_store3、测试向表中vector_store 插入数据service/** * 向量数据库表 vector_store 业务操作接口类 */publicinterfaceIVectorStoreService{/** * 简单示例往向量数据库中插入字符串类型的数据 * param knowledge * return */StringaddSimple(Stringknowledge);/** * 从向量数据库中筛选文档 * param content * return */ListDocumentsimilaritySearch(Stringcontent);}serviceImplServiceSlf4jpublicclassVectorStoreServiceImplimplementsIVectorStoreService{AutowiredprivatePgVectorStorepgVectorStore;AutowiredQualifier(openAiChatModel)privateChatModelchatModel;OverridepublicStringaddSimple(Stringknowledge){DocumentdocumentnewDocument(knowledge);pgVectorStore.add(List.of(document));return添加知识库成功;}/** * 根据内容相识度查询 * param content */publicListDocumentsimilaritySearch(Stringcontent){QueryquerynewQuery(content);ChatClient.BuilderchatClientBuilderChatClient.builder(chatModel);// 构建查询重写转换器RewriteQueryTransformerqueryTransformerRewriteQueryTransformer.builder().chatClientBuilder(chatClientBuilder).build();// 构建翻译成中文转换器/* QueryTransformer queryTransformer TranslationQueryTransformer.builder() .chatClientBuilder(chatClientBuilder) .targetLanguage(Chinese) .build();*/// 重写QuerytransformqueryTransformer.transform(query);SearchRequestsearchRequestSearchRequest.builder().query(transform.text())//搜索的查询文本,重写后的查询.topK(5)// 返回的最大结果数.similarityThreshold(0.5)// 相似度阈值分数用于筛选搜索结果。只有相似度得分大于或等于该“阈值”的文档才会被返回。请注意这是一个在客户端而非服务端执行的后处理步骤。阈值设为 0.0 表示接受任意相似度或禁用相似度阈值过滤阈值设为 1.0 则表示要求完全匹配。//.filterExpression(title in [如何提升自身魅力吸引潜在伴侣]) //基于文档元数据的过滤表达式.build();// Retrieve documents similar to a queryListDocumentresultspgVectorStore.similaritySearch(searchRequest);log.info(匹配到的知识库内容{},results.toArray());returnresults;}}测试方法这里就直接写controller了在页面上测试/** * 向量数据库接口 */RestControllerRequestMapping(/vectorStore)publicclassVectorStoreController{AutowiredprivateIVectorStoreServicevectorStoreService;/** * 新增数据 * 向vector_store插入数据 * param knowledge 字符串类型的知识 */PostMapping(/add)publicStringaddSimple(Stringknowledge){returnvectorStoreService.addSimple(knowledge);}/** * 查询-直接接口查询 * param content * return */GetMapping(/query)publicListDocumentsimilaritySearch(Stringcontent){returnvectorStoreService.similaritySearch(content);}}先测试下插入数据查看数据库发现插入成功embedding字段即为向量数组metadata元信息为空是因为我们暂时还没有设置。继续多插入几条测试下检索功能发现只匹配到一条分数为0.664、哪为什么会检索到这条呢先将用户输入的信息向量化再通过jdbc在数据库中匹配5、总结在这里其实我们对RAG中的向量化检索有初步的了解了。在这篇文章中主要是将向量数据库pgvector集成到项目中并用简单的插入表检索表了解了向量化。在检索文档前会将用户输入的文本转化为向量表示再从表中检索内容。【下图红色圈出部分】附上一张RAG的架构图

相关新闻

2026/8/26 20:20:56

FastAPI + SQLAlchemy2.0 异步数据库

FastAPI 集成 SQLAlchemy2.0 异步数据库 主流 Python ORM 对比 Python 生态有很多 ORM 库:SQLAlchemy、Peewee、Pony ORM、Tortoise‑ORM。 SQLAlchemy:生态最成熟,支持异步,社区活跃 SQLModel:FastAPI 作者开发&…

2026/8/26 20:20:56

mentor PRO操作要点

手动创建symbol_右键新建设置格点(0.1in)文本0.05引脚可以复制黏贴(改pin num和pin type)GND_1原点放在左下角Excel创建symbol需要.csv文件IC 新建symbol-右键import pin,引脚shift选中往里拖Padstack_edit---oblong(长宽)mm新建一…

2026/8/26 21:05:59

构建AI代码审查自动化管道:让Copilot与Claude无缝协作

1. 项目概述:当AI开始互相“挑刺”如果你和我一样,日常开发中重度依赖像 GitHub Copilot(基于 Codex 模型)和 Claude 这类 AI 编程助手,那你肯定经历过这个场景:在 IDE 里,Copilot 给你生成了一…

2026/8/26 21:05:59

AI落地页生成器技术拆解:从页面DSL到工程化部署

当我们在讨论 AI 建站工具时,最容易看到的是成品:输入一句话,几秒钟后生成一整套 Hero、关于我们、产品特性、价格、FAQ 区块。真正值得关心的技术问题是,这套页面在系统内部到底是以什么形式被表示、存储和传递的。如果把这个标题…

2026/8/26 21:05:59

低代码平台AI原生集成:从知识库到流程自动化的落地关键

低代码 AI 这个方向,讨论的人很多,真正做明白的很少。很多平台把 AI 能力做成一个外挂功能,看起来能用,一接真实业务就露馅。2026 年再看低代码平台,最关键的一条判断标准应该是:AI 是不是原生集成到数据、…

2026/8/26 21:00:59

泊松-玻尔兹曼方程:从静电学到生物分子模拟的跨学科桥梁

1. 从“带电粒子”到“连续介质”:一个物理思想的跃迁 如果你研究过电解质溶液、胶体分散体系,或者半导体器件的物理特性,那么“泊松-玻尔兹曼方程”这个名字你一定不会陌生。它看起来是一个复杂的数学公式,但它的诞生&#xff0c…

2026/8/26 9:13:28

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/25 11:48:27

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/25 16:56:43

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/26 0:04:32

Python random 模块常用函数详解:从入门到实战

目录 1. 引言2. 准备工作3. 基础随机函数4. 序列相关函数5. 随机种子与复现6. 实战案例7. 注意事项8. 常见问题与排查9. 总结 1. 引言 摘要: 本文系统介绍 Python 标准库 random 模块中最常用的随机数生成函数。内容涵盖基础随机函数(random()、unifor…

2026/8/26 1:19:35

JSON总结

JSON概念 JSON(JavaScript Object Notation) 是一种轻量级的数据交换格式,主要用于跟服务器进行交换数据。它基于ECMAScript的一个子集。 JSON采用完全独立于语言的文本格式,但是也使用了类似于C语言家族的习惯(包括C、C、C#、Java、JavaScr…

2026/8/26 1:19:35

保存连接sse 是什么原理,为什么不会一直请求

“保持连接”用的是 SSE(Server-Sent Events),本质是一个没有马上结束的 HTTP 请求。 过程是: 拷贝机发送一次请求: GET /api/code-sync/events服务器返回: Content-Type: text/event-stream但不关闭响应&…

2026/8/26 19:34:06

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/26 19:17:08

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/26 19:34:05

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…