Skip to content

Coding Agent 研发工程师训练营从零实现 AI 编程工具

8 周 40 课,把 Agent Loop、工具、沙箱、编辑、Trace 与 Evaluation 组合成一个真正能运行的 Mini Code Agent。

你最终会做出什么

训练营的最终项目是一个终端版 Mini Code Agent。它能接收自然语言任务,进入指定代码仓库,搜索和读取代码,制定计划,修改文件,运行测试,理解失败并重试,最后输出 Git diff、执行 Trace 和 Evaluation 报告。

课程不会用一个 Agent 框架把关键机制藏起来。你会亲手实现 Runtime 的核心边界:模型协议、Agent Loop、Tool Registry、Repo Context、Patch Editor、Permission Policy、Process Executor、Task State、Trace Logger、Evaluation Runner、Skills、Plugins、MCP-lite 和 Subagents。

两条代码轨道

独立实验轨

40 课中的每一课都有独立代码目录:

  • starter/:API 完整、保留本课练习缺口的起始代码。
  • solution/:经过测试的完整参考实现。
  • tests/:只检查公开行为的黑盒验收。
  • lab.json:课程编号、命令、权限和总项目映射。

你可以从任意一课开始,不必复制上一课的工程状态。

渐进项目轨

同一项能力还会进入 projects/mini-code-agent。每周末保存一个完整可运行检查点,帮助你看清系统如何从最小循环逐渐长成工程化产品。

8 周路线

周次主题周末可演示成果
第 1 周最小 Agent、CLI、模型协议Fake Model 调用工具并完成任务
第 2 周Tool Registry、文件与搜索、上下文预算Agent 能安全理解一个小型仓库
第 3 周权限、命令执行、测试解析允许的测试可运行,危险命令被拦截
第 4 周文件编辑、Patch、Diff、恢复自动修复一个真实 Bug
第 5 周Planning、状态、恢复、项目指令中断后可以安全继续长任务
第 6 周Trace、Viewer、Benchmark、Eval每次运行都可观察、可评分
第 7 周Skills、Plugins、MCP-lite、Subagents扩展能力受权限和预算约束
第 8 周真实模型适配、产品化、结营完整作品集与 15 分钟答辩 Demo

验证原则

“目录存在”不等于课程完成。训练营只有在 40 个 Starter 按声明原因失败、40 个 Solution 全部通过、8 个检查点可运行、Benchmark 报告可复现、网站可构建、Word 成品逐页检查通过时,才会被标记为完成。

真实模型调用是可选演示。必过验证不会读取你的 API Key,也不会访问公网。

从零实现 Mini Code Agent Runtime