Skip to content

24 小时 / 7 天 / 30 天间隔复习卡

使用方法:

  1. 遮住教材和代码,用 3–8 分钟回答一张卡;
  2. 必须写或说出“因为……所以……”以及可验证证据;
  3. 回答后再打开对应章节;
  4. 若关键状态、边界或失败条件遗漏,把同一卡安排到次日重做。

第 0 章:Agent 全景

24 小时

不看资料画出 LLM + 上下文 + 工具 + Harness。为每一项写“输入、输出、失败方式”。
证据:一张图;能指出最终答案正确但轨迹缺失仍不可靠。

7 天

把客服 Agent 的 RAG、Skill、MCP、Hook、Goal 放进同一架构图,并解释依赖方向。
证据:每个概念只有一个主要职责,不互相替代。

30 天

面对“做一个旅行 Agent”,列出最小闭环、权限边界、状态事件和三个评估指标。
证据:设计可迁移,但仍保持 Agent 公式与 Harness 边界。

第 1 章:什么是 Agent

24 小时

口述一次模型提出工具调用到最终回答的完整消息序列。
证据:包含 call ID、参数校验、工具结果回填和停止条件。

7 天

解释“模型可以选择工具”为什么不等于“模型有权执行工具”。
证据:给出一个 CapabilityPolicy 阻止副作用的例子。

30 天

不看旧代码写一个最小 Agent Loop 伪代码,并标记五个可观察事件。
证据:异常和迭代上限都有终态。

第 2 章:百行 Agent Loop

24 小时

从百行 Loop 中圈出 model、registry、policy、messages、events 五个边界。
证据:能解释任一边界混在一起会导致什么。

7 天

给 Loop 增加一个异步工具和一个会抛错的工具,预测事件序列。
证据:先预测,再跑测试对比。

30 天

把 Loop 改造成 AsyncIterator[AgentEvent] 接口设计。
证据:消费者可实时观察,而无需解析控制台文本。

第 3 章:记忆与 Skill 进化

24 小时

把五条信息分别放入用户记忆、知识库、运行轨迹或 Skill。
证据:每条说明权威来源、时效和写入者。

7 天

画出轨迹脱敏、模式提取、候选、保留集、人工批准和发布。
证据:候选无发布权限,稳定版不被覆盖。

30 天

为一个新领域设计 Skill 自进化门禁。
证据:包含质量、成本、安全、确定性测试与回滚,不使用单一总分。

第 4 章:任务规划

24 小时

把“把项目上线”改成 4 个有输入、产物、检查的步骤。
证据:每一步完成与否可由外部证据判断。

7 天

某一步失败后重排 Plan,但保持 Goal 不变。
证据:标出复用的已验证步骤和新增假设。

30 天

为包含并行和依赖的任务画 DAG,并写 ready-step 判定。
证据:无依赖冲突、无循环依赖、失败传播可解释。

第 5 章:Subagent

24 小时

写一份委派合同:目标、范围、允许动作、产物、证据、完成条件。
证据:子 Agent 无需猜测主任务隐含要求。

7 天

模拟子 Agent 返回“已完成但无证据”,由父 Agent 退回。
证据:退回原因具体,补充后可重新验收。

30 天

为一个研究+编码任务判断哪些可委派、哪些必须主 Agent 保留。
证据:考虑上下文隔离、写冲突和最终责任。

第 6 章:Agent Team

24 小时

画出三个角色的所有权、消息和共享产物。
证据:任何文件和最终决策都有唯一 owner。

7 天

制造两个成员的结论冲突,用证据仲裁。
证据:保留原始来源,不用角色权威或多数票替代验证。

30 天

把一个串行流程改成有限并行 Team。
证据:说明为什么这些任务独立,以及汇合点如何处理部分失败。

第 7 章:Tool、Skill 与 MCP

24 小时

用一个客服例子分别解释 Tool、Skill 和 MCP。
证据:Tool 可执行、Skill 描述方法、MCP 提供互操作协议。

7 天

从 MCP initialize 追踪到 tools/call,并加入 Bearer 与 scope。
证据:区分认证失败和授权失败。

30 天

设计一个可移植 Skill 与远程 MCP 配套发布方案。
证据:标准 SKILL.md 不依赖平台扩展,远程工具遵循最小权限。

第 8 章:Hooks 与评估

24 小时

画出 Event → Matcher → Handler → Decision,各举一个 allow、ask、deny。
证据:说明注册顺序、短路和 Hook 异常策略。

7 天

从一条轨迹构造 Result、Process、Quality 三类验证。
证据:每个结论带 evidence,软判断和确定性事实分开。

30 天

为 Skill 或 MR 设计发布门禁。
证据:安全回退不可被质量抵消,P0/P1 只有证据通过后才阻断。

第 9 章:Goal 目标驱动

24 小时

不用例子之外的词,分别定义 turn、run、task、plan、Goal。
证据:五个定义互不重叠,并能组成层级。

7 天

手算“失败、失败、进展、失败、失败、失败”的停滞计数和状态。
证据:进展后清零,最后一次进入 paused。

30 天

为长期数据迁移设计 Goal Contract 和状态机。
证据:有 waiting/resume 条件、用户 cancel、预算 terminate 和完成证据。

第 10 章:Mini Emperor 综合项目

24 小时

从 Web 客服请求画到 RAG、引用、事件和页面。
证据:说出真实 API 路径、run 状态和拒答分支。

7 天

完成一次 ZIP 临时安装、Bearer MCP 调用和候选发布/回滚。
证据:保存 SHA-256、scope 结果、版本状态和测试输出,不污染真实 Agent 目录。

30 天

在干净环境完成毕业演示:

  1. 打开 Skill Hub;
  2. 在线运行客服并查看引用;
  3. 从中间事件恢复 SSE;
  4. 下载、验证并安装 Skill;
  5. 通过远程 MCP 调用同一能力;
  6. 发布候选、隔离并回滚;
  7. 触发 feature/* → master MR 审核;
  8. 展示 P0/P1 阻断与 P2/P3 提示。

证据:演示记录必须包含 API 响应、事件 ID、校验和、版本状态、MR Artifact 和失败案例。

跨章节终极卡

30 天复习完成后,不看资料回答:

一个 Agent 如何从“能调用工具”成长为“可供别人使用、可观察、可评估、可发布、可回滚”的系统?

合格回答必须连起:

text
Loop → Context/Memory → Plan/Subagent/Team → Tool/Skill/MCP
→ Hook/Trajectory/Verifier → Goal
→ RAG/SSE/Package/Auth/Evolution/MR Gate

并在每个箭头处说明:传递了什么状态、谁有权限、失败如何被发现、完成由什么证据证明。

章节检查点 · 复习系统说明 · 教材目录

Markdown 是唯一内容源,HTML 由构建流程生成。