从多智能体到提示注入:awesome-ai-agent-papers 5大核心分类全解析

发布时间:2026/10/11 22:49:15

从多智能体到提示注入:awesome-ai-agent-papers 5大核心分类全解析 【免费下载链接】awesome-ai-agent-papersA curated collection of AI agent research papers released in 2026, covering agent engineering, memory, evaluation, workflows, and autonomous systems.项目地址https://gitcode.com/gh_mirrors/aw/awesome-ai-agent-papers点击查看免费下载awesome-ai-agent-papers 是一个持续精选 2026 年发布的 AI 智能体研究论文的开源合集已收录 364 篇 arXiv 论文每周更新。本文带你一次性看懂仓库中的 5 大核心分类——多智能体协作、记忆与 RAG、评估与可观测性、智能体工具链、智能体安全让你几分钟就能定位自己需要的研究论文。1 分钟了解这个论文库 awesome-ai-agent-papers解决了一个很实际的问题arXiv 每周有数百篇论文涉及 AI Agent但真正与智能体生态直接相关的只是其中一部分。这个仓库人工筛选了这些论文并统一归档到 5 个分类里你不需要自己大海捞针。分类论文数覆盖内容Multi-Agent多智能体54协作、通信、编排、协商Memory RAG记忆与检索57记忆系统、知识检索、RAG 管道Eval Observability评估与可观测86基准测试、监控、调试、追踪Agent Tooling智能体工具链98框架、训练、优化、上下文工程AI Agent Security智能体安全83攻击、防御、对齐、提示注入所有论文只收录2026 年 1 月以后发布、且与 AI/LLM 智能体开发直接相关的内容每周从 arXiv 更新适合三类人构建智能体系统的 AI 工程师、探索新架构的研究者、把 LLM 智能体集成到产品中的开发者。5 大核心分类全解析各分类到底在研究什么分类一Multi-Agent 多智能体——多个 AI 如何分工协作这一分类研究的核心问题是当一个任务复杂到单个智能体搞不定时多个智能体怎么组队典型研究方向包括编排架构多个 LLM 独立分析同一问题再由合并智能体选出最佳答案无需任何训练ORCH自进化系统通过共享持久记忆、异步执行和心跳式干预让多智能体系统持续自我进化改进速率比固定基线高 3–10 倍CORAL动态路由与协商每一轮推理时通过语义匹配动态重连智能体间的通信拓扑DyTopo或让买方-卖方智能体用自然语言完成 110 项交易任务AgenticPay冷思考也有论文指出多智能体团队未必比最强单个成员更强Multi-Agent Teams Hold Experts Back帮你避免盲目上多智能体完整论文列表见 Multi-Agent 分类README.md 第 91–158 行。分类二Memory RAG 记忆与检索——给智能体装上长期记忆 智能体要长期可靠地工作记得住和找得回是关键。这一分类聚焦两条主线记忆架构把记忆管理拆成可学习的原子 CRUD 操作AtomMem、模仿生物遗忘机制的指数衰减与记忆融合FadeMem、以及面向终身交互的高效记忆压缩SimpleMemRAG 增强用图结构专家替代扁平分块检索来理解实体关系与流程SOPRAG、把语料离线编译成可导航的技能树、查询时不再检索而是导航Corpus2Skill、以及面向长文档的熵门控懒加载策略L-RAG无论你是做企业知识库问答还是个性化助理这里都能找到落地的记忆方案。完整列表见 Memory RAG 分类README.md 第 162–228 行。分类三Eval Observability 评估与可观测性——智能体怎么测、怎么盯这是论文数量第二多的分类86 篇因为智能体到底靠不靠谱目前只能靠系统化测试回答真实环境基准ClawBench 在 163 个真实生产网站上运行 283 项日常任务只拦截最后一步写操作让智能体在真实站点端到端跑而又不产生副作用Terminal-Bench 则提供 89 个高难度命令行任务失效诊断量化多智能体系统长期运行中的行为退化Agent Drift、给出 12 类工具调用错误分类When Agents Fail to Act、以及从 48000 个模拟故障场景中归纳出 16 种常见推理失败模式轨迹验证DRIFT 用轻量探针在生成结果到达用户之前拦截事实性错误开销低于 0.1%如果你正在给团队搭建智能体这类论文能直接指导你建立测试和监控体系。完整列表见 Eval Observability 分类README.md 第 232–326 行。分类四Agent Tooling 工具链——智能体工程的实践工具箱 这是最工程向的分类98 篇覆盖框架设计、训练优化、规划与上下文工程设计模式从系统论视角拆解智能体为 5 个功能子系统提炼出 12 个可复用设计模式Agentic Design Patterns自进化智能体能审查并更新自身工具、提示词甚至核心代码的编码智能体已在线部署 161 天Ouroboros上下文工程实测在 9,649 组实验中验证 YAML、JSON、Markdown 等上下文格式对智能体准确率的真实影响成本优化把重复出现的工具调用序列打包成确定性元工具跳过不必要的中间推理步骤直接降低 token 消耗完整列表见 Agent Tooling 分类README.md 第 330–442 行。分类五AI Agent Security 智能体安全——提示注入攻防红线 智能体越自主安全风险越大。这一分类83 篇是整个仓库的安全底线从攻击到防御全覆盖提示注入用强化学习自动生成能跨多个前沿模型迁移的注入攻击Learning to Inject对 78 项研究做系统综述建立攻击投递向量、模态、传播三维度分类法协议安全Model Context ProtocolMCP的协议级安全分析、安全 MCP 方案SMCP、以及 WASM 沙箱中执行不受信 MCP 工具的扫描框架记忆与 RAG 投毒记忆投毒攻击与防御、知识库爬取式窃取攻击RAGCrawler、以及一个被污染的页面就足以让推荐系统推荐不存在的品牌运行时治理诊断式护栏框架AgentDoG、轨迹异常检测、以及基于访问控制策略学习的行为治理AgentGuardian只要你的智能体接了外部内容或工具这个分类就必读。完整列表见 AI Agent Security 分类README.md 第 446–538 行。快速上手3 步用好这个论文库 ✅打开主文件直接阅读 README.md5 个分类以可折叠区块组织展开对应区块即可浏览该分类全部论文每篇都附有 1–2 句大白话解读按分类定位对照 CONTRIBUTING.md 第 17–23 行 的分类定义——Tooling 管框架与优化、Memory RAG 管记忆检索、Multi-Agent 管协作通信、Eval Observability 管测试监控、Security 管攻防安全——按你的需求直奔对应区块跟踪更新仓库每周从 arXiv 更新把仓库加入星标或定期查看即可跟上最新论文如何贡献3 步提交一篇论文 ✍️如果你想把新论文加入合集流程非常简单克隆仓库git clone https://gitcode.com/gh_mirrors/aw/awesome-ai-agent-papers按格式添加条目在 CONTRIBUTING.md 中定义的格式下把论文加到对应分类附 1–2 句面向开发者的平实描述要求论文已发布于 arXiv、且与智能体生态直接相关提交 PRPR 标题统一使用Add paper: 论文标题格式提交前确认链接可用项目采用 MIT 协议开源详见 LICENSE。注意这是一个策展列表论文由各作者独立创作发布仓库本身不对所列研究的内容做背书。写在最后从多智能体编排到提示注入防御awesome-ai-agent-papers 把 2026 年 AI 智能体领域最值得读的 364 篇论文整理成了 5 个清晰的分类。无论你是想搭建多智能体系统、优化记忆检索、建立评估体系还是补齐安全短板都建议从这里开始你的论文之旅。赞分享【免费下载链接】awesome-ai-agent-papersA curated collection of AI agent research papers released in 2026, covering agent engineering, memory, evaluation, workflows, and autonomous systems.项目地址https://gitcode.com/gh_mirrors/aw/awesome-ai-agent-papers点击查看免费下载相关推荐SurfSense 多智能体系统提示词解析core_behavior 如何约束主 Agent 的核心行为SurfSense 多智能体系统提示词解析core_behavior 如何约束主 Agent 的核心行为 导读 在 SurfSense 这个开源 Notebo人工智能AI 应用后端AI Agent网页爬虫RAG深度研究MCP 服务前端Mamba技术深度解析状态空间模型线性复杂度长序列训练与推理完整指南Mamba技术深度解析状态空间模型线性复杂度长序列训练与推理完整指南 把上下文推到 32K 时Transformer 的注意力矩阵和 KV 缓存随序列长度平人工智能深度学习基础模型从五子棋到智能协作Qwen-Agent多Agent框架核心机制解析从五子棋到智能协作Qwen Agent多Agent框架核心机制解析 你是否曾想过让多个AI智能体协同工作共同完成复杂任务Qwen Agent作为基于Qwe人工智能大模型AI AgentAgent 框架工具调用RAG创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
延伸阅读

更多相关文章

2026/10/11 22:44:15

Codex驱动的Windows C盘空间审计方法论

1. 项目概述:这不是清理垃圾,而是一场系统级空间审计“我用 Codex,给 C 盘腾出 300 多 GB”——这句话在技术社区刷屏时,我第一反应不是惊讶,而是立刻打开任务管理器看了眼自己机器上那个常年卡在98%的C盘使用率。很多…

2026/10/11 22:44:15

MCP协议与Skills架构:Agent工程化落地实战指南

1. 项目概述:这不是又一个“AI概念课”,而是一份可执行的Agent工程实践路线图“MCPAgent Skills”这个组合词在2025年下半年突然密集出现在多个技术社区的讨论帖、GitHub star飙升的仓库名、以及某主流视频平台的算法推荐流里。它不是某个新发布的框架&a…

2026/10/11 22:44:15

LangChain 1.3实战:PDF字段提取与跨文档比对的生产级方案

1. 这不是“又一个LangChain教程”,而是一份能让你真正写出可用AI应用的实战手记 你点开这个标题,大概率是因为—— 刚在B站搜“LangChain 教程”,前五页全是“30分钟入门”“保姆级讲解”“从零开始”,结果点进去发现&#xff1…

2026/10/11 23:54:20

GDNet4.0.0目标检测包实战指南:从解压到训练部署

简介:这是一份面向Unity及C#开发者的高并发游戏网络框架GDNet 4.0.0压缩包,涵盖ET、KBEngine、Photon等常见网络方案的设计思路,主要解决Moba、MMORPG等大型游戏在分布式部署、双端共享代码及第三方数据库接入方面的痛点。框架基于System.Net…

2026/10/11 23:54:20

Oracle 11gR2 透明网关安装配置与跨库查询避坑指南

简介:Oracle Database 11gR2 (linux.x64_11gR2_gateways.zip) 是适用于Linux x86-64平台的Oracle Database Gateways 11g第2版(11.2.0.1.0)软件包,主要面向需要在Oracle数据库与异构数据源之间建立透明连接的DBA和开发工程师,常用于Oracle与S…

2026/10/11 23:54:20

数据库实验三:存储过程与触发器实战指南

数据库系统原理实验三——存储过程、触发器实验,听名字就知道,这轮要开始跨过“写单条SQL”那道门槛,进入“在数据库里写程序”的阶段了。存储过程和触发器,一个是数据库里可以反复调用的程序块,一个是表上自动触发的逻…

2026/10/11 23:54:20

IEC 61131-3标准详解:从五种编程语言到工程化PLC编程实践

1. 先聊清楚:IEC 61131到底在“标准化”什么做PLC编程的人,迟早都会遭遇一次灵魂拷问:为什么项目里别人写的程序我读起来费劲?为什么不同的PLC型号之间代码没法直接迁移?如果你一直在某一家厂商的生态里工作&#xff0…

2026/10/11 23:54:20

2026美赛A题备赛:时序预测全流程实战指南

1. 为什么2026年美赛A题值得把时序预测当作重点准备方向最近后台好多备赛的同学都在问同一个问题:2026年美赛A题如果真考到时间序列类的题目,该怎么准备?说实话,这个问题问得挺准。美赛A题历来以“连续型问题”为主,常…

2026/10/11 23:49:20

停机时间不是看出来的:OEE 里那 15% 的损失藏在哪

结论先行:OEE 算虚高,往往是因为漏算了三块小损失多数中小厂自己统计的 OEE 偏高,不是因为设备真的好,而是漏算了三类损失:几分钟的微停机、降速运行、开机不良。这三块加起来,常常被低估 10~15…

2026/10/11 0:02:13

Python调用Gemini Structured Outputs实现工单路由门禁

客服工单最怕的不是模型“答错一句话”,而是它给出一段看起来合理的说明,程序却从中猜错优先级。通俗做法是:要求模型只交 JSON(JavaScript Object Notation,轻量数据格式),再让代码验证它。Gem…

2026/10/11 0:02:13

Spring Boot超市进销存系统毕设实战:从需求拆解到答辩通关

最近带的一个学生项目组里,有A同学跑来问我:选什么毕设题目最稳妥,既能让评审老师觉得工作量够,又不会在答辩时被问到语无伦次。我第一反应就是推荐基于Spring Boot的超市仓库管理系统——也就是超市进销存系统。这个题目乍一看平…

2026/10/11 0:02:13

Flutter StatefulWidget 生命周期核心解析

很多刚开始接触 Flutter 的朋友,在看完一堆“Hello World”和基础组件之后,大概率都会撞上同一堵墙:StatefulWidget 里那堆 initState、build、dispose 方法,到底什么时候被调用?为什么顺序是那样?在里面到…

2026/10/11 0:02:13

Python调用Gemini Structured Outputs实现工单路由门禁

客服工单最怕的不是模型“答错一句话”,而是它给出一段看起来合理的说明,程序却从中猜错优先级。通俗做法是:要求模型只交 JSON(JavaScript Object Notation,轻量数据格式),再让代码验证它。Gem…

2026/10/11 0:02:13

Spring Boot超市进销存系统毕设实战:从需求拆解到答辩通关

最近带的一个学生项目组里,有A同学跑来问我:选什么毕设题目最稳妥,既能让评审老师觉得工作量够,又不会在答辩时被问到语无伦次。我第一反应就是推荐基于Spring Boot的超市仓库管理系统——也就是超市进销存系统。这个题目乍一看平…

2026/10/11 0:02:13

Flutter StatefulWidget 生命周期核心解析

很多刚开始接触 Flutter 的朋友,在看完一堆“Hello World”和基础组件之后,大概率都会撞上同一堵墙:StatefulWidget 里那堆 initState、build、dispose 方法,到底什么时候被调用?为什么顺序是那样?在里面到…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑