第 01 篇 · Agent 的定义与环境搭建
这个系列文章我们会先从零开发一个最小可用的Agent出来,可以配置不同的大模型,添加自定义的工具,自己设计技能skills,使用cli的方式来调用Agent,观察Agent的执行过程和工具是如何使用的。
这个项目我们把它称为my-agent.
课程后半段我们会提供一个完整的Agent项目,通过源码导读的方式来讲解,源码是完整的参考实现,文章负责讲清楚原理,模块边界和实现思路。有开发经验的同学可以只看文章的实现思路和技术讲解,自己就可以复现,想要节省时间的同学可以对照源码学习。
这个项目我们不依赖第三方的Agent开发框架,所有技术细节都自己处理,前半段 我们通过写Python 代码和Cli来完成。关于Web接口,SSE,Vue前端实现我们放到后半段,通过一个mini-openclaw的Agent项目来学习。
每一篇只讲一个功能模块,先讲原理,再讲如何实现,前半段文章中会给出完整的代码实现,后半段以源码对照和关键伪代码为主。
这一篇我们先不写代码,先把Agent是什么给讲清楚,再把开发环境配置好。
这套课程怎么学
前半段是动手写最小版本。需要亲手写出 LLM 调用、Function Calling、多轮循环、工具和 Skills,并通过 CLI 观察每一步发生了什么。这样后面看源码时,不会被工程细节绕晕。
后半段看完整项目的做法。MCP、SSE、前端、子 Agent、事件流、Trace、回放、评估这些部分,代码量已经不适合在文章中整篇贴出来。文章会给架构图、协议、关键伪代码和源码位置。你可以跟着源码读,也可以按文章里的设计自己实现。
学习路线
目前初版规划的章节路线如下:
什么是Agent
如果让我们给Agent下一个定义,我想可以这么说