Codex Prompt 在控制什么
Codex 的 Developer Prompt 可以看成六个控制面:人格与表达、用户协作、工程执行、文件与 Git 安全、技能路由、工具协议。它们共同决定 Agent 怎么把一句需求变成一连串可核验动作。
其中最容易被忽略的是:Prompt 不只影响回答文字,也影响 Agent 会不会读取仓库、是否持续执行到构建通过、何时向用户请求权限,以及怎样处理工作区中已有修改。
技能不是知识库,而是运行时流程
技能会告诉 Agent 在特定任务中必须读取哪些说明、使用哪些工具、按什么顺序验证。模型能力没有变化,但流程被收窄成更稳定的路径。
这和把一大段最佳实践永久塞进主 Prompt 不同。技能按任务触发,可以减少无关上下文,也能让不同领域各自维护自己的执行规范。
多 Agent 的重点不是数量
委派是否有效取决于任务能否独立、上下文是否完整、结果如何回收到主任务。如果只是把互相依赖的步骤同时发出去,最后会把协调成本转移给主 Agent。
Codex 的多 Agent 规则因此关注模型继承、上下文 fork 和委派权限。它体现的工程原则是:并行只是优化手段,任务所有权和验收标准才是核心。
工具协议为什么很长
每个工具都要定义输入、输出、权限和异步状态。比如命令可能立即结束,也可能返回一个仍在运行的会话;文件补丁有严格格式;浏览器操作需要页面状态证据。模型只有理解这些协议,才可能稳定完成跨工具工作流。
从版本差异看 Agent 演进
阅读 Codex 全部版本 时,可以按三个问题检查变化:是否新增了外部能力,是否改变了自主执行边界,是否强化了交付验证。再与 Claude Code 对比,会比孤立阅读某一段 Prompt 更容易理解设计取舍。