Skip to content

《从零实现 Agent》完整学习手册

这不是一份“链接合集”,而是一条可以从零跑通的工程学习路线。主线始终围绕:

Agent = LLM + 上下文 + 工具;Harness 负责让这三者可靠地循环、受控地执行并留下可观察状态。

教材把 9 期视频、claude-agent-examples 的累积式代码、《深入理解 AI Agent》的实验,以及本地 Mini Emperor 项目合成一条连续路线。每章都先解释用途和失败,再看机制、状态和代码,最后用实验验证。

先选一条阅读路线

路线 A:按章节从零学习

  1. Agent 全景
  2. 什么是 Agent
  3. 百行 Agent Loop
  4. 记忆与 Skill 进化
  5. 任务规划
  6. Subagent
  7. Agent Team
  8. Tool、Skill 与 MCP
  9. Hooks 与评估
  10. Goal 目标驱动
  11. Mini Emperor 综合项目

路线 B:按七周完成作品

教材章节本周能做出来的东西
第 1 周00–02可观察的 CLI Agent Loop
第 2 周03、08标准 Skill、记忆边界、候选 Skill 评估
第 3 周04–05带引用与转人工的中文客服 RAG
第 4 周06–07可供别人连接的客服 MCP Server
第 5 周08–09Hooks、轨迹评估、灰度与回滚
第 6 周02、05、08GitLab MR 自动审核与分级门禁
第 7 周10Skill Hub、Web 运行、下载安装与毕业演示

路线 C:按问题查找

你现在的问题直接阅读
LLM 和 Agent 到底差在哪?第 1 章
模型为什么会调用工具?第 2 章
记忆、RAG、Skill 为什么不能混在一起?第 3 章
一个大任务如何拆成可执行步骤?第 4 章
什么时候需要子代理?第 5 章
多个 Agent 怎样协作而不互相污染上下文?第 6 章
Tool、Skill、MCP 各解决什么问题?第 7 章
如何知道 Agent 做得好不好?第 8 章
如何让 Agent 围绕长期目标持续推进?第 9 章
如何把 Skill 放到 Web 上给别人用?第 10 章

路线 D:今天只有 30 分钟

  1. 用 5 分钟读一章的“这个能力有什么用”和“没有它会发生什么”。
  2. 用 10 分钟手画“完整流程”,再对照 Mermaid 图。
  3. 用 10 分钟运行“逐步实现”中的最小命令。
  4. 用 5 分钟完成“无资料复述”的第一问。

不要在 30 分钟内追求看完一章。目标是获得一个能运行、能观察、能解释的最小闭环。

开始前准备

需要 Python 3.12、Node.js 20+、uv、Git 和 Docker。模型密钥只放在本地 .env,不要写入命令历史、教材、浏览器代码、日志或提交记录。

从工作区根目录运行:

bash
./scripts/sync-reference-repos.sh
uv sync --extra dev
cd mini-emperor/frontend && npm install

验证固定参考版本:

bash
git -C references/repos/claude-agent-examples rev-parse HEAD
git -C references/repos/ai-agent-book rev-parse HEAD

期望分别得到:

text
54a18980334541773f13940aa0c0475728d30ee0
1c18370279f8f0457bf2c44dfa585d08d4d5f281

如何使用每一章

每章都使用同一节奏:

阅读时保留两个窗口:

  • 左侧看教材,理解为什么和流程。
  • 右侧打开对应代码并实际运行,观察事件、状态和失败。

章末的“深入学习导航”不是让你全部通读。先做标为“必读”的一项,并提交它要求的完成证据。

来源标签

标签含义如何定位
【视频】本地 9 期视频字幕的提炼视频编号 + [HH:MM:SS–HH:MM:SS]
【CAE】claude-agent-examples 固定版本commit + 文件路径 + symbol/行号
【书】《深入理解 AI Agent》固定版本章节或实验目录 + 文件
【工程】本地 Mini Emperor 实现文件 + 类/函数 + 测试
【官方】协议或产品的第一方文档文档标题 + 稳定 URL + 阅读小节
【论文】论文原文论文 + 重点图/章节

Markdown 与 HTML

  • Markdown 源文件都在 agent-course/book/,适合边读边改、做批注和查看 Git 差异。
  • 构建后的静态网页在 agent-course/html/,适合搜索、暗色阅读、移动端查看和打印。
  • 本地启动 HTML 学习站:
bash
cd agent-course
npm install
npm run docs:dev

教材内容只维护一份 Markdown;HTML 是自动构建结果,避免两个版本逐渐不一致。

如果只阅读构建成品,运行 npm run docs:preview 后访问 http://127.0.0.1:4173/;这种方式可以完整使用搜索、Mermaid 和章节进度。

学习完成的证据

“看懂”不能作为完成标准。每章至少留下:

  1. 一个可运行的增量或实验;
  2. 一份关键状态/事件记录;
  3. 一个被你主动制造并解释的失败;
  4. 一次不看资料的口头或书面复述;
  5. 对章末一个深入来源的阅读证据。

课程总进度记录在学习记录,毕业标准见课程任务,全部书中实验见实验地图

Markdown 是唯一内容源,HTML 由构建流程生成。