40 个独立 Lab
每课都有可运行 Starter、完整 Solution、黑盒测试和验收 Rubric,可以独立学习和复习。
8 周 40 课,把 Agent Loop、工具、沙箱、编辑、Trace 与 Evaluation 组合成一个真正能运行的 Mini Code Agent。
训练营的最终项目是一个终端版 Mini Code Agent。它能接收自然语言任务,进入指定代码仓库,搜索和读取代码,制定计划,修改文件,运行测试,理解失败并重试,最后输出 Git diff、执行 Trace 和 Evaluation 报告。
课程不会用一个 Agent 框架把关键机制藏起来。你会亲手实现 Runtime 的核心边界:模型协议、Agent Loop、Tool Registry、Repo Context、Patch Editor、Permission Policy、Process Executor、Task State、Trace Logger、Evaluation Runner、Skills、Plugins、MCP-lite 和 Subagents。
40 课中的每一课都有独立代码目录:
starter/:API 完整、保留本课练习缺口的起始代码。solution/:经过测试的完整参考实现。tests/:只检查公开行为的黑盒验收。lab.json:课程编号、命令、权限和总项目映射。你可以从任意一课开始,不必复制上一课的工程状态。
同一项能力还会进入 projects/mini-code-agent。每周末保存一个完整可运行检查点,帮助你看清系统如何从最小循环逐渐长成工程化产品。
| 周次 | 主题 | 周末可演示成果 |
|---|---|---|
| 第 1 周 | 最小 Agent、CLI、模型协议 | Fake Model 调用工具并完成任务 |
| 第 2 周 | Tool Registry、文件与搜索、上下文预算 | Agent 能安全理解一个小型仓库 |
| 第 3 周 | 权限、命令执行、测试解析 | 允许的测试可运行,危险命令被拦截 |
| 第 4 周 | 文件编辑、Patch、Diff、恢复 | 自动修复一个真实 Bug |
| 第 5 周 | Planning、状态、恢复、项目指令 | 中断后可以安全继续长任务 |
| 第 6 周 | Trace、Viewer、Benchmark、Eval | 每次运行都可观察、可评分 |
| 第 7 周 | Skills、Plugins、MCP-lite、Subagents | 扩展能力受权限和预算约束 |
| 第 8 周 | 真实模型适配、产品化、结营 | 完整作品集与 15 分钟答辩 Demo |
“目录存在”不等于课程完成。训练营只有在 40 个 Starter 按声明原因失败、40 个 Solution 全部通过、8 个检查点可运行、Benchmark 报告可复现、网站可构建、Word 成品逐页检查通过时,才会被标记为完成。
真实模型调用是可选演示。必过验证不会读取你的 API Key,也不会访问公网。