从多智能体到提示注入:awesome-ai-agent-papers 5大核心分类全解析
【免费下载链接】awesome-ai-agent-papersA curated collection of AI agent research papers released in 2026, covering agent engineering, memory, evaluation, workflows, and autonomous systems.项目地址https://gitcode.com/gh_mirrors/aw/awesome-ai-agent-papers点击查看免费下载awesome-ai-agent-papers 是一个持续精选 2026 年发布的 AI 智能体研究论文的开源合集已收录 364 篇 arXiv 论文每周更新。本文带你一次性看懂仓库中的 5 大核心分类——多智能体协作、记忆与 RAG、评估与可观测性、智能体工具链、智能体安全让你几分钟就能定位自己需要的研究论文。1 分钟了解这个论文库 awesome-ai-agent-papers解决了一个很实际的问题arXiv 每周有数百篇论文涉及 AI Agent但真正与智能体生态直接相关的只是其中一部分。这个仓库人工筛选了这些论文并统一归档到 5 个分类里你不需要自己大海捞针。分类论文数覆盖内容Multi-Agent多智能体54协作、通信、编排、协商Memory RAG记忆与检索57记忆系统、知识检索、RAG 管道Eval Observability评估与可观测86基准测试、监控、调试、追踪Agent Tooling智能体工具链98框架、训练、优化、上下文工程AI Agent Security智能体安全83攻击、防御、对齐、提示注入所有论文只收录2026 年 1 月以后发布、且与 AI/LLM 智能体开发直接相关的内容每周从 arXiv 更新适合三类人构建智能体系统的 AI 工程师、探索新架构的研究者、把 LLM 智能体集成到产品中的开发者。5 大核心分类全解析各分类到底在研究什么分类一Multi-Agent 多智能体——多个 AI 如何分工协作这一分类研究的核心问题是当一个任务复杂到单个智能体搞不定时多个智能体怎么组队典型研究方向包括编排架构多个 LLM 独立分析同一问题再由合并智能体选出最佳答案无需任何训练ORCH自进化系统通过共享持久记忆、异步执行和心跳式干预让多智能体系统持续自我进化改进速率比固定基线高 3–10 倍CORAL动态路由与协商每一轮推理时通过语义匹配动态重连智能体间的通信拓扑DyTopo或让买方-卖方智能体用自然语言完成 110 项交易任务AgenticPay冷思考也有论文指出多智能体团队未必比最强单个成员更强Multi-Agent Teams Hold Experts Back帮你避免盲目上多智能体完整论文列表见 Multi-Agent 分类README.md 第 91–158 行。分类二Memory RAG 记忆与检索——给智能体装上长期记忆 智能体要长期可靠地工作记得住和找得回是关键。这一分类聚焦两条主线记忆架构把记忆管理拆成可学习的原子 CRUD 操作AtomMem、模仿生物遗忘机制的指数衰减与记忆融合FadeMem、以及面向终身交互的高效记忆压缩SimpleMemRAG 增强用图结构专家替代扁平分块检索来理解实体关系与流程SOPRAG、把语料离线编译成可导航的技能树、查询时不再检索而是导航Corpus2Skill、以及面向长文档的熵门控懒加载策略L-RAG无论你是做企业知识库问答还是个性化助理这里都能找到落地的记忆方案。完整列表见 Memory RAG 分类README.md 第 162–228 行。分类三Eval Observability 评估与可观测性——智能体怎么测、怎么盯这是论文数量第二多的分类86 篇因为智能体到底靠不靠谱目前只能靠系统化测试回答真实环境基准ClawBench 在 163 个真实生产网站上运行 283 项日常任务只拦截最后一步写操作让智能体在真实站点端到端跑而又不产生副作用Terminal-Bench 则提供 89 个高难度命令行任务失效诊断量化多智能体系统长期运行中的行为退化Agent Drift、给出 12 类工具调用错误分类When Agents Fail to Act、以及从 48000 个模拟故障场景中归纳出 16 种常见推理失败模式轨迹验证DRIFT 用轻量探针在生成结果到达用户之前拦截事实性错误开销低于 0.1%如果你正在给团队搭建智能体这类论文能直接指导你建立测试和监控体系。完整列表见 Eval Observability 分类README.md 第 232–326 行。分类四Agent Tooling 工具链——智能体工程的实践工具箱 这是最工程向的分类98 篇覆盖框架设计、训练优化、规划与上下文工程设计模式从系统论视角拆解智能体为 5 个功能子系统提炼出 12 个可复用设计模式Agentic Design Patterns自进化智能体能审查并更新自身工具、提示词甚至核心代码的编码智能体已在线部署 161 天Ouroboros上下文工程实测在 9,649 组实验中验证 YAML、JSON、Markdown 等上下文格式对智能体准确率的真实影响成本优化把重复出现的工具调用序列打包成确定性元工具跳过不必要的中间推理步骤直接降低 token 消耗完整列表见 Agent Tooling 分类README.md 第 330–442 行。分类五AI Agent Security 智能体安全——提示注入攻防红线 智能体越自主安全风险越大。这一分类83 篇是整个仓库的安全底线从攻击到防御全覆盖提示注入用强化学习自动生成能跨多个前沿模型迁移的注入攻击Learning to Inject对 78 项研究做系统综述建立攻击投递向量、模态、传播三维度分类法协议安全Model Context ProtocolMCP的协议级安全分析、安全 MCP 方案SMCP、以及 WASM 沙箱中执行不受信 MCP 工具的扫描框架记忆与 RAG 投毒记忆投毒攻击与防御、知识库爬取式窃取攻击RAGCrawler、以及一个被污染的页面就足以让推荐系统推荐不存在的品牌运行时治理诊断式护栏框架AgentDoG、轨迹异常检测、以及基于访问控制策略学习的行为治理AgentGuardian只要你的智能体接了外部内容或工具这个分类就必读。完整列表见 AI Agent Security 分类README.md 第 446–538 行。快速上手3 步用好这个论文库 ✅打开主文件直接阅读 README.md5 个分类以可折叠区块组织展开对应区块即可浏览该分类全部论文每篇都附有 1–2 句大白话解读按分类定位对照 CONTRIBUTING.md 第 17–23 行 的分类定义——Tooling 管框架与优化、Memory RAG 管记忆检索、Multi-Agent 管协作通信、Eval Observability 管测试监控、Security 管攻防安全——按你的需求直奔对应区块跟踪更新仓库每周从 arXiv 更新把仓库加入星标或定期查看即可跟上最新论文如何贡献3 步提交一篇论文 ✍️如果你想把新论文加入合集流程非常简单克隆仓库git clone https://gitcode.com/gh_mirrors/aw/awesome-ai-agent-papers按格式添加条目在 CONTRIBUTING.md 中定义的格式下把论文加到对应分类附 1–2 句面向开发者的平实描述要求论文已发布于 arXiv、且与智能体生态直接相关提交 PRPR 标题统一使用Add paper: 论文标题格式提交前确认链接可用项目采用 MIT 协议开源详见 LICENSE。注意这是一个策展列表论文由各作者独立创作发布仓库本身不对所列研究的内容做背书。写在最后从多智能体编排到提示注入防御awesome-ai-agent-papers 把 2026 年 AI 智能体领域最值得读的 364 篇论文整理成了 5 个清晰的分类。无论你是想搭建多智能体系统、优化记忆检索、建立评估体系还是补齐安全短板都建议从这里开始你的论文之旅。赞分享【免费下载链接】awesome-ai-agent-papersA curated collection of AI agent research papers released in 2026, covering agent engineering, memory, evaluation, workflows, and autonomous systems.项目地址https://gitcode.com/gh_mirrors/aw/awesome-ai-agent-papers点击查看免费下载相关推荐SurfSense 多智能体系统提示词解析core_behavior 如何约束主 Agent 的核心行为SurfSense 多智能体系统提示词解析core_behavior 如何约束主 Agent 的核心行为 导读 在 SurfSense 这个开源 Notebo人工智能AI 应用后端AI Agent网页爬虫RAG深度研究MCP 服务前端Mamba技术深度解析状态空间模型线性复杂度长序列训练与推理完整指南Mamba技术深度解析状态空间模型线性复杂度长序列训练与推理完整指南 把上下文推到 32K 时Transformer 的注意力矩阵和 KV 缓存随序列长度平人工智能深度学习基础模型从五子棋到智能协作Qwen-Agent多Agent框架核心机制解析从五子棋到智能协作Qwen Agent多Agent框架核心机制解析 你是否曾想过让多个AI智能体协同工作共同完成复杂任务Qwen Agent作为基于Qwe人工智能大模型AI AgentAgent 框架工具调用RAG创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考