24 小时 / 7 天 / 30 天间隔复习卡
使用方法:
- 遮住教材和代码,用 3–8 分钟回答一张卡;
- 必须写或说出“因为……所以……”以及可验证证据;
- 回答后再打开对应章节;
- 若关键状态、边界或失败条件遗漏,把同一卡安排到次日重做。
第 0 章:Agent 全景
24 小时
不看资料画出 LLM + 上下文 + 工具 + Harness。为每一项写“输入、输出、失败方式”。
证据:一张图;能指出最终答案正确但轨迹缺失仍不可靠。
7 天
把客服 Agent 的 RAG、Skill、MCP、Hook、Goal 放进同一架构图,并解释依赖方向。
证据:每个概念只有一个主要职责,不互相替代。
30 天
面对“做一个旅行 Agent”,列出最小闭环、权限边界、状态事件和三个评估指标。
证据:设计可迁移,但仍保持 Agent 公式与 Harness 边界。
第 1 章:什么是 Agent
24 小时
口述一次模型提出工具调用到最终回答的完整消息序列。
证据:包含 call ID、参数校验、工具结果回填和停止条件。
7 天
解释“模型可以选择工具”为什么不等于“模型有权执行工具”。
证据:给出一个 CapabilityPolicy 阻止副作用的例子。
30 天
不看旧代码写一个最小 Agent Loop 伪代码,并标记五个可观察事件。
证据:异常和迭代上限都有终态。
第 2 章:百行 Agent Loop
24 小时
从百行 Loop 中圈出 model、registry、policy、messages、events 五个边界。
证据:能解释任一边界混在一起会导致什么。
7 天
给 Loop 增加一个异步工具和一个会抛错的工具,预测事件序列。
证据:先预测,再跑测试对比。
30 天
把 Loop 改造成 AsyncIterator[AgentEvent] 接口设计。
证据:消费者可实时观察,而无需解析控制台文本。
第 3 章:记忆与 Skill 进化
24 小时
把五条信息分别放入用户记忆、知识库、运行轨迹或 Skill。
证据:每条说明权威来源、时效和写入者。
7 天
画出轨迹脱敏、模式提取、候选、保留集、人工批准和发布。
证据:候选无发布权限,稳定版不被覆盖。
30 天
为一个新领域设计 Skill 自进化门禁。
证据:包含质量、成本、安全、确定性测试与回滚,不使用单一总分。
第 4 章:任务规划
24 小时
把“把项目上线”改成 4 个有输入、产物、检查的步骤。
证据:每一步完成与否可由外部证据判断。
7 天
某一步失败后重排 Plan,但保持 Goal 不变。
证据:标出复用的已验证步骤和新增假设。
30 天
为包含并行和依赖的任务画 DAG,并写 ready-step 判定。
证据:无依赖冲突、无循环依赖、失败传播可解释。
第 5 章:Subagent
24 小时
写一份委派合同:目标、范围、允许动作、产物、证据、完成条件。
证据:子 Agent 无需猜测主任务隐含要求。
7 天
模拟子 Agent 返回“已完成但无证据”,由父 Agent 退回。
证据:退回原因具体,补充后可重新验收。
30 天
为一个研究+编码任务判断哪些可委派、哪些必须主 Agent 保留。
证据:考虑上下文隔离、写冲突和最终责任。
第 6 章:Agent Team
24 小时
画出三个角色的所有权、消息和共享产物。
证据:任何文件和最终决策都有唯一 owner。
7 天
制造两个成员的结论冲突,用证据仲裁。
证据:保留原始来源,不用角色权威或多数票替代验证。
30 天
把一个串行流程改成有限并行 Team。
证据:说明为什么这些任务独立,以及汇合点如何处理部分失败。
第 7 章:Tool、Skill 与 MCP
24 小时
用一个客服例子分别解释 Tool、Skill 和 MCP。
证据:Tool 可执行、Skill 描述方法、MCP 提供互操作协议。
7 天
从 MCP initialize 追踪到 tools/call,并加入 Bearer 与 scope。
证据:区分认证失败和授权失败。
30 天
设计一个可移植 Skill 与远程 MCP 配套发布方案。
证据:标准 SKILL.md 不依赖平台扩展,远程工具遵循最小权限。
第 8 章:Hooks 与评估
24 小时
画出 Event → Matcher → Handler → Decision,各举一个 allow、ask、deny。
证据:说明注册顺序、短路和 Hook 异常策略。
7 天
从一条轨迹构造 Result、Process、Quality 三类验证。
证据:每个结论带 evidence,软判断和确定性事实分开。
30 天
为 Skill 或 MR 设计发布门禁。
证据:安全回退不可被质量抵消,P0/P1 只有证据通过后才阻断。
第 9 章:Goal 目标驱动
24 小时
不用例子之外的词,分别定义 turn、run、task、plan、Goal。
证据:五个定义互不重叠,并能组成层级。
7 天
手算“失败、失败、进展、失败、失败、失败”的停滞计数和状态。
证据:进展后清零,最后一次进入 paused。
30 天
为长期数据迁移设计 Goal Contract 和状态机。
证据:有 waiting/resume 条件、用户 cancel、预算 terminate 和完成证据。
第 10 章:Mini Emperor 综合项目
24 小时
从 Web 客服请求画到 RAG、引用、事件和页面。
证据:说出真实 API 路径、run 状态和拒答分支。
7 天
完成一次 ZIP 临时安装、Bearer MCP 调用和候选发布/回滚。
证据:保存 SHA-256、scope 结果、版本状态和测试输出,不污染真实 Agent 目录。
30 天
在干净环境完成毕业演示:
- 打开 Skill Hub;
- 在线运行客服并查看引用;
- 从中间事件恢复 SSE;
- 下载、验证并安装 Skill;
- 通过远程 MCP 调用同一能力;
- 发布候选、隔离并回滚;
- 触发
feature/* → masterMR 审核; - 展示 P0/P1 阻断与 P2/P3 提示。
证据:演示记录必须包含 API 响应、事件 ID、校验和、版本状态、MR Artifact 和失败案例。
跨章节终极卡
30 天复习完成后,不看资料回答:
一个 Agent 如何从“能调用工具”成长为“可供别人使用、可观察、可评估、可发布、可回滚”的系统?
合格回答必须连起:
Loop → Context/Memory → Plan/Subagent/Team → Tool/Skill/MCP
→ Hook/Trajectory/Verifier → Goal
→ RAG/SSE/Package/Auth/Evolution/MR Gate并在每个箭头处说明:传递了什么状态、谁有权限、失败如何被发现、完成由什么证据证明。