《从零实现 Agent》完整学习手册
这不是一份“链接合集”,而是一条可以从零跑通的工程学习路线。主线始终围绕:
Agent = LLM + 上下文 + 工具;Harness 负责让这三者可靠地循环、受控地执行并留下可观察状态。
教材把 9 期视频、claude-agent-examples 的累积式代码、《深入理解 AI Agent》的实验,以及本地 Mini Emperor 项目合成一条连续路线。每章都先解释用途和失败,再看机制、状态和代码,最后用实验验证。
先选一条阅读路线
路线 A:按章节从零学习
- Agent 全景
- 什么是 Agent
- 百行 Agent Loop
- 记忆与 Skill 进化
- 任务规划
- Subagent
- Agent Team
- Tool、Skill 与 MCP
- Hooks 与评估
- Goal 目标驱动
- Mini Emperor 综合项目
路线 B:按七周完成作品
| 周 | 教材章节 | 本周能做出来的东西 |
|---|---|---|
| 第 1 周 | 00–02 | 可观察的 CLI Agent Loop |
| 第 2 周 | 03、08 | 标准 Skill、记忆边界、候选 Skill 评估 |
| 第 3 周 | 04–05 | 带引用与转人工的中文客服 RAG |
| 第 4 周 | 06–07 | 可供别人连接的客服 MCP Server |
| 第 5 周 | 08–09 | Hooks、轨迹评估、灰度与回滚 |
| 第 6 周 | 02、05、08 | GitLab MR 自动审核与分级门禁 |
| 第 7 周 | 10 | Skill Hub、Web 运行、下载安装与毕业演示 |
路线 C:按问题查找
| 你现在的问题 | 直接阅读 |
|---|---|
| LLM 和 Agent 到底差在哪? | 第 1 章 |
| 模型为什么会调用工具? | 第 2 章 |
| 记忆、RAG、Skill 为什么不能混在一起? | 第 3 章 |
| 一个大任务如何拆成可执行步骤? | 第 4 章 |
| 什么时候需要子代理? | 第 5 章 |
| 多个 Agent 怎样协作而不互相污染上下文? | 第 6 章 |
| Tool、Skill、MCP 各解决什么问题? | 第 7 章 |
| 如何知道 Agent 做得好不好? | 第 8 章 |
| 如何让 Agent 围绕长期目标持续推进? | 第 9 章 |
| 如何把 Skill 放到 Web 上给别人用? | 第 10 章 |
路线 D:今天只有 30 分钟
- 用 5 分钟读一章的“这个能力有什么用”和“没有它会发生什么”。
- 用 10 分钟手画“完整流程”,再对照 Mermaid 图。
- 用 10 分钟运行“逐步实现”中的最小命令。
- 用 5 分钟完成“无资料复述”的第一问。
不要在 30 分钟内追求看完一章。目标是获得一个能运行、能观察、能解释的最小闭环。
开始前准备
需要 Python 3.12、Node.js 20+、uv、Git 和 Docker。模型密钥只放在本地 .env,不要写入命令历史、教材、浏览器代码、日志或提交记录。
从工作区根目录运行:
bash
./scripts/sync-reference-repos.sh
uv sync --extra dev
cd mini-emperor/frontend && npm install验证固定参考版本:
bash
git -C references/repos/claude-agent-examples rev-parse HEAD
git -C references/repos/ai-agent-book rev-parse HEAD期望分别得到:
text
54a18980334541773f13940aa0c0475728d30ee0
1c18370279f8f0457bf2c44dfa585d08d4d5f281如何使用每一章
每章都使用同一节奏:
阅读时保留两个窗口:
- 左侧看教材,理解为什么和流程。
- 右侧打开对应代码并实际运行,观察事件、状态和失败。
章末的“深入学习导航”不是让你全部通读。先做标为“必读”的一项,并提交它要求的完成证据。
来源标签
| 标签 | 含义 | 如何定位 |
|---|---|---|
【视频】 | 本地 9 期视频字幕的提炼 | 视频编号 + [HH:MM:SS–HH:MM:SS] |
【CAE】 | claude-agent-examples 固定版本 | commit + 文件路径 + symbol/行号 |
【书】 | 《深入理解 AI Agent》固定版本 | 章节或实验目录 + 文件 |
【工程】 | 本地 Mini Emperor 实现 | 文件 + 类/函数 + 测试 |
【官方】 | 协议或产品的第一方文档 | 文档标题 + 稳定 URL + 阅读小节 |
【论文】 | 论文原文 | 论文 + 重点图/章节 |
Markdown 与 HTML
- Markdown 源文件都在
agent-course/book/,适合边读边改、做批注和查看 Git 差异。 - 构建后的静态网页在
agent-course/html/,适合搜索、暗色阅读、移动端查看和打印。 - 本地启动 HTML 学习站:
bash
cd agent-course
npm install
npm run docs:dev教材内容只维护一份 Markdown;HTML 是自动构建结果,避免两个版本逐渐不一致。
如果只阅读构建成品,运行 npm run docs:preview 后访问 http://127.0.0.1:4173/;这种方式可以完整使用搜索、Mermaid 和章节进度。
学习完成的证据
“看懂”不能作为完成标准。每章至少留下:
- 一个可运行的增量或实验;
- 一份关键状态/事件记录;
- 一个被你主动制造并解释的失败;
- 一次不看资料的口头或书面复述;
- 对章末一个深入来源的阅读证据。