本文详细解析了 Agent 系统的组成,提出了 Agent = Model + Context + Tools + State + Loop 的公式,并介绍了 Agent 系统的五层架构和十二条贯穿线。文章还列举了 Agent 系统的十二个关键模块,并解释了 ReAct、Loop、Graph 和 Harness 四个核心概念。最后,文章探讨了 Agent 系统的演进路线,帮助读者了解自己在 Agent 开发中的阶段,并提供了一份 Agent 系统模块与 Hermes 框架的映射表。
从公式到架构,一次看懂 Agent 系统由什么组成、缺了哪块会怎样
把 Agent 当成"LLM+Prompt",是 2026 年最贵的一个误解。我每天在用的 Hermes,拆开看有 12 个模块,模型只是其中一块——而且是最不神秘的那块。这篇文章把这 12 块拆开摆桌上,让你看清一个 Agent 到底由什么组成、每块管什么、缺了哪块会出什么问题。
一先破一个公式
Agent = Model + Context + Tools + State + Loop
LLM 回答一个问题;Agent 完成一个目标。差的就是这五项:
- Model
:提供判断力,本身不做事
- Context
:模型此刻能看到的信息(系统指令、任务状态、检索结果、工具输出)
- Tools
:能对外部世界动手——读写文件、开浏览器、调接口
- State
:干到哪一步、攒了什么中间结果
- Loop
:循环。观察 → 行动 → 再观察,直到任务结束
这个公式决定你的调试思路。模型答错,你换模型或改提示词;但 Agent 跑偏、失忆、半路死掉,问题基本都在后四项,不在模型。我见过太多人给跑偏的 Agent 换更强的大模型,结果该偏还是偏——因为问题出在 Context 污染或者 Loop 缺停止条件,换模型治不了。
二一张图看懂整体架构
一个完整的 Agent 系统有五层,从上到下:
架构图:Agent 系统五层架构与六条贯穿线
- ① Experience 层
:CLI / Web / Chat / API / IDE / Voice / Cron / Webhook
- ② Orchestration 层
:Task / Planning / Graph / Subagent / Handoff
- ③ Agent Runtime
:Agent / ReAct / Loop / Context / Memory / Skills / Tools
- ④ Harness 层
:State / Persistence / Recovery / Sandbox / Permission / Scheduler / Cost / Lifecycle / Human Approval
- ⑤ Environment 层
:MCP / API / Browser / Shell / Files / DB / Git / SaaS
纵向还有六条贯穿线:Context、Memory、Evaluation、Observability、Security、Governance——它们不属于任何一层,每一层都要过。
读图方式:用户从 ① 进来,智能在 ③,④ 负责让它安全地活着,⑤ 是手脚;② 只在任务复杂到需要组织时才显形。大部分人做的"Agent",其实只有 ③ 的一半。
三12 个模块速览
| # | 模块 | 职责 | 大白话 |
|---|---|---|---|
| 01 | Interface | 与用户和外部系统交互 | 用户从哪进来 |
| 02 | Task / Goal | 定义目标与任务 | 到底要干啥 |
| 03 | Planning | 目标转执行计划 | 分几步走 |
| 04 | Graph / Orchestration | 组织复杂任务与 Agent | 谁先谁后谁并行 |
| 05 | Agent | 智能决策 | 下一步做什么 |
| 06 | ReAct / Loop | 驱动持续执行 | 做完一步接着做 |
| 07 | Context | 管理当前信息 | 此刻需要知道什么 |
| 08 | Memory | 管理长期知识 | 过去记住了什么 |
| 09 | Tools / MCP / Skills | 提供行动能力 | 能对外部世界做什么 |
| 10 | State / Persistence | 保存运行状态 | 干到哪了、怎么续上 |
| 11 | Harness | 管理 Agent 生命周期 | 怎么安全地活着 |
| 12 | Evaluation / Observability / Security | 评估、监控、治理 | 干得好不好、有没有越界 |
记法:01-04 是"接任务",05-06 是"干活",07-09 是"凭什么是你干",10-12 是"怎么干得久、干得稳"。
四四个概念,一个常见误区
ReAct、Loop、Graph、Harness,这四个词是理解 Agent 系统的钥匙,也是被混用得最狠的四个词。
| 概念 | 解决的问题 | 一句话 |
|---|---|---|
| ReAct | 当前这一步怎么做决策 | Reason → Act → Observe 循环 |
| Loop | 怎么让 Agent 持续跑 | 状态、重试、超时、检查点、恢复 |
| Graph | 复杂任务怎么组织 | 并行、分支、合并、子代理 |
| Harness | 整个生命周期怎么被控制 | 权限、成本、沙箱、审计 |
最常见的坑:上来就想用 Graph 替代 Loop,理由是"图编排更高级"。这是误解。Graph 组织的是任务,不是执行;Loop 驱动的是执行,不是任务。 层级关系是:Graph 组织任务 → Agent 决策 → Loop 驱动执行 → ReAct 做局部判断,Harness 把这一切包住。四者是不同层次的工程抽象,谁也替代不了谁。
五演进路线:你现在在第几阶段
Agent 系统不是一步到位的,它是沿着工程责任一层层长出来的:
| 层级 | 核心形态 | 新增的工程责任 |
|---|---|---|
| LLM Call | 单次模型调用 | Prompt、输入输出格式 |
| Script | 脚本包裹模型 | 参数、异常处理、批处理 |
| Workflow | 多步骤流程 | 路由、并行、重试、审批 |
| Agent | 根据观察选行动 | 计划、工具、反馈、状态 |
| Agent Runtime | 托管 Agent 执行 | 调度、权限、日志、恢复 |
| Agent OS | 统一内核能力 | 记忆/状态/工具/事件/策略总线 |
对照着自检:还在"调提示词",你在第一层;你的 Agent 跑两天就挂,缺的是 Loop 和 State(第四层);多任务互相打架,缺 Graph;不敢让它自主跑,缺 Harness。
这套分法不是标准答案,各家框架的叫法不一样,但骨架大致如此。知道自己缺哪层,比追新框架有用得多。
如何学习大模型 AI ?
由于新岗位的生产效率,要优于被取代岗位的生产效率,所以实际上整个社会的生产效率是提升的。
但是具体到个人,只能说是:
“最先掌握AI的人,将会比较晚掌握AI的人有竞争优势”。
这句话,放在计算机、互联网、移动互联网的开局时期,都是一样的道理。
我在一线互联网企业工作十余年里,指导过不少同行后辈。帮助很多人得到了学习和成长。
我意识到有很多经验和知识值得分享给大家,也可以通过我们的能力和经验解答大家在人工智能学习中的很多困惑,所以在工作繁忙的情况下还是坚持各种整理和分享。但苦于知识传播途径有限,很多互联网行业朋友无法获得正确的资料得到学习提升,故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。
这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】
为什么要学习大模型?
我国在A大模型领域面临人才短缺,数量与质量均落后于发达国家。2023年,人才缺口已超百万,凸显培养不足。随着AI技术飞速发展,预计到2025年,这一缺口将急剧扩大至400万,严重制约我国AI产业的创新步伐。加强人才培养,优化教育体系,国际合作并进是破解困局、推动AI发展的关键。
大模型入门到实战全套学习大礼包
1、大模型系统化学习路线
作为学习AI大模型技术的新手,方向至关重要。 正确的学习路线可以为你节省时间,少走弯路;方向不对,努力白费。这里我给大家准备了一份最科学最系统的学习成长路线图和学习规划,带你从零基础入门到精通!
2、大模型学习书籍&文档
学习AI大模型离不开书籍文档,我精选了一系列大模型技术的书籍和学习文档(电子版),它们由领域内的顶尖专家撰写,内容全面、深入、详尽,为你学习大模型提供坚实的理论基础。
3、AI大模型最新行业报告
2025最新行业报告,针对不同行业的现状、趋势、问题、机会等进行系统地调研和评估,以了解哪些行业更适合引入大模型的技术和应用,以及在哪些方面可以发挥大模型的优势。
4、大模型项目实战&配套源码
学以致用,在项目实战中检验和巩固你所学到的知识,同时为你找工作就业和职业发展打下坚实的基础。
5、大模型大厂面试真题
面试不仅是技术的较量,更需要充分的准备。在你已经掌握了大模型技术之后,就需要开始准备面试,我精心整理了一份大模型面试题库,涵盖当前面试中可能遇到的各种技术问题,让你在面试中游刃有余。
适用人群
第一阶段(10天):初阶应用
该阶段让大家对大模型 AI有一个最前沿的认识,对大模型 AI 的理解超过 95% 的人,可以在相关讨论时发表高级、不跟风、又接地气的见解,别人只会和 AI 聊天,而你能调教 AI,并能用代码将大模型和业务衔接。
- 大模型 AI 能干什么?
- 大模型是怎样获得「智能」的?
- 用好 AI 的核心心法
- 大模型应用业务架构
- 大模型应用技术架构
- 代码示例:向 GPT-3.5 灌入新知识
- 提示工程的意义和核心思想
- Prompt 典型构成
- 指令调优方法论
- 思维链和思维树
- Prompt 攻击和防范
- …
第二阶段(30天):高阶应用
该阶段我们正式进入大模型 AI 进阶实战学习,学会构造私有知识库,扩展 AI 的能力。快速开发一个完整的基于 agent 对话机器人。掌握功能最强的大模型开发框架,抓住最新的技术进展,适合 Python 和 JavaScript 程序员。
- 为什么要做 RAG
- 搭建一个简单的 ChatPDF
- 检索的基础概念
- 什么是向量表示(Embeddings)
- 向量数据库与向量检索
- 基于向量检索的 RAG
- 搭建 RAG 系统的扩展知识
- 混合检索与 RAG-Fusion 简介
- 向量模型本地部署
- …
第三阶段(30天):模型训练
恭喜你,如果学到这里,你基本可以找到一份大模型 AI相关的工作,自己也能训练 GPT 了!通过微调,训练自己的垂直大模型,能独立训练开源多模态大模型,掌握更多技术方案。
到此为止,大概2个月的时间。你已经成为了一名“AI小子”。那么你还想往下探索吗?
- 为什么要做 RAG
- 什么是模型
- 什么是模型训练
- 求解器 & 损失函数简介
- 小实验2:手写一个简单的神经网络并训练它
- 什么是训练/预训练/微调/轻量化微调
- Transformer结构简介
- 轻量化微调
- 实验数据集的构建
- …
第四阶段(20天):商业闭环
对全球大模型从性能、吞吐量、成本等方面有一定的认知,可以在云端和本地等多种环境下部署大模型,找到适合自己的项目/创业方向,做一名被 AI 武装的产品经理。
- 硬件选型
- 带你了解全球大模型
- 使用国产大模型服务
- 搭建 OpenAI 代理
- 热身:基于阿里云 PAI 部署 Stable Diffusion
- 在本地计算机运行大模型
- 大模型的私有化部署
- 基于 vLLM 部署大模型
- 案例:如何优雅地在阿里云私有部署开源大模型
- 部署一套开源 LLM 项目
- 内容安全
- 互联网信息服务算法备案
- …
学习是一个过程,只要学习就会有挑战。天道酬勤,你越努力,就会成为越优秀的自己。
如果你能在15天内完成所有的任务,那你堪称天才。然而,如果你能完成 60-70% 的内容,你就已经开始具备成为一名大模型 AI 的正确特征了。