AGENT ATLAS
FIELD NOTES / 技术演进图谱INTERACTIVE EDITION
THE EVOLUTION OF AGENT DEVELOPMENT
从感知世界,
到完成任务。
Agent 开发的历史与趋势全景图。沿着推理、记忆、行动与工程四条主线,理解智能体如何从研究原型,演变为可交付工作的系统。
FIG. 01 / 智能体的最小工作闭环GOAL → ACTION → FEEDBACK
01 /
概念很早,开发范式很新Agent 的历史早于大语言模型
02 /
模型能力 × 系统工程可靠性来自整个执行闭环
03 /
下一站:可持续交付从一次演示,到可验证的任务
一张地图,读懂六次转向
横向阅读时代变迁,纵向追踪开发能力。点击节点,展开背景与原始资料。
点击探索 · 支持搜索
左右滑动地图,查看各个时代 →
没有匹配节点,试试更短的关键词。
阅读说明:节点按主要贡献归类;同一技术可能跨越多条主线。留白表示本图未选入节点,不代表该时期没有相关研究。
核心转向
从“给模型一段提示”,走向为任务设计一套系统:知道何时行动,保留必要状态,并验证是否真正完成。
把一个 Agent 拆开来看
六个职责层共同工作。点击任一层,查看关键问题与常用构件。
THE AGENT DEVELOPMENT STACK
用户目标 → 执行反馈 → 可验证的产物
先选择控制方式,再增加复杂度
这三种架构是工程取舍,不是能力等级。长时运行可以叠加到任何一种。
从你的任务出发
开发原则
先建立简单架构的任务成功率基线,再用质量、时延与费用证明增加 Agent 或编排层的价值。阅读架构指南 ↗
下一阶段,什么会变得重要?
以已发生的进展为线索,观察未来 1—3 年的工程方向。
THE NEXT FRONTIER自主性越强,
自主性越强,
越需要可验证的系统。
模型能力扩展了“可以尝试什么”;运行时、记忆、协议和评估,决定了“可以稳定交付什么”。以下为趋势判断,点击卡片查看证据与不确定性。
趋势不是确定时间表。这里不预测“全自主”的实现年份,也不将特定演示或基准成绩外推为所有任务的可靠性。
可以追溯的全景,才值得参考
原始论文、项目历史与官方文档,构成这张图谱的证据底座。
范围与时间口径
制作日期:2026-10-03。精选资料最晚覆盖至 2026-08-17;并非全量新闻索引。早期节点采用项目起点或原论文年份;实践文章标记其发表时间,不表示概念在该日发明。
如何区分事实与判断
历史节点的“发生了什么”依据来源;“为何重要”“能力边界”为工程归纳。趋势详情分别列出已发生的证据、趋势判断及仍待解决的问题。框架示例不代表市场份额排名。