叶小钗

第 01 篇 · Agent 的定义与环境搭建

这个是我们Agent开发系列的第一篇文章

这个系列文章我们会先从零开发一个最小可用的Agent出来,可以配置不同的大模型,添加自定义的工具,自己设计技能skills,使用cli的方式来调用Agent,观察Agent的执行过程和工具是如何使用的。

这个项目我们把它称为my-agent.

课程后半段我们会提供一个完整的Agent项目,通过源码导读的方式来讲解,源码是完整的参考实现,文章负责讲清楚原理,模块边界和实现思路。有开发经验的同学可以只看文章的实现思路和技术讲解,自己就可以复现,想要节省时间的同学可以对照源码学习。

这个项目我们不依赖第三方的Agent开发框架,所有技术细节都自己处理,前半段 我们通过写Python 代码和Cli来完成。关于Web接口,SSE,Vue前端实现我们放到后半段,通过一个mini-openclaw的Agent项目来学习。

每一篇只讲一个功能模块,先讲原理,再讲如何实现,前半段文章中会给出完整的代码实现,后半段以源码对照和关键伪代码为主。

这一篇我们先不写代码,先把Agent是什么给讲清楚,再把开发环境配置好。

这套课程怎么学

前半段是动手写最小版本。需要亲手写出 LLM 调用、Function Calling、多轮循环、工具和 Skills,并通过 CLI 观察每一步发生了什么。这样后面看源码时,不会被工程细节绕晕。

后半段看完整项目的做法。MCP、SSE、前端、子 Agent、事件流、Trace、回放、评估这些部分,代码量已经不适合在文章中整篇贴出来。文章会给架构图、协议、关键伪代码和源码位置。你可以跟着源码读,也可以按文章里的设计自己实现。

学习路线

目前初版规划的章节路线如下:

阶段
篇章
目标
学习方式
最小内核
01-04
写出能调用工具的 CLI Agent
跟着文章敲代码
CLI 观察
05
在终端看清 token、tool_call、tool_result 的执行过程
跟着文章敲代码
能力扩展
06-07
工具注册、Skills
跟着文章敲代码
平台化
08-09
MCP、Agent 配置
原理 + 关键实现 + 源码对照
Web 形态
10
FastAPI SSE、前端流式聊天、管理界面
源码导读
长任务能力
11-12
上下文压缩、长期/短期记忆
原理 + 关键实现
多 Agent
13-14
子 Agent、任务委派、编排模式
源码导读
可观测
15-18
事件流、Trace、Metrics、回放、评估
源码导读
生产化
19-20
部署、安全、完整架构复盘
工程清单 + 架构复盘

什么是Agent

Image

如果让我们给Agent下一个定义,我想可以这么说