2026-09-08 Agent 工作流
Agent 工作流是把「跟人聊天写代码」拆成可重复的执行循环:接意图、决定要不要停下来问、改哪些文件、何时并行、谁来验收、下一批何时开。
两篇新博文分别打在这个循环的两端。一篇写单会话:Codex 跳过提问确认,按推测继续。一篇写多会话:并行开一堆会话,人验收不过来,还可能互相改文件。
定义
- 单会话循环:接任务 → 澄清或推测 → 改代码 → 等人看 → 再继续。失败点是「该问的时候不问」。
- 多会话编排:任务池 → 分批 / 并行 → 防文件交叉 → 人验收改状态。失败点是「产出比人看得快」。
人介入(澄清、确认、验收)是这条工作流里的约束,不是单独的主题。省略它们,工作流会自己跑飞。
单会话:问还是继续
- 最新版 Codex 工作流的问题:不问确认、一路跑到底看起来更顺。意图含糊或有错别字时,模型按推测改仓库,人没盯着就会把额度与偏航一起放大。
- 对称失败见 跟 AI 说 ok,它为什么有时不继续:等太久会停,不等会把误解执行到底。该问就问,该放行就用明确许可。
工作流设计问题是:哪些节点必须等人,哪些节点可以自动续跑。
多会话:并行、锁、分批、验收
- Vibe Coding 开了一堆会话,验收不过来:上限是人的验收带宽。做法是按不重叠模块分批;人负责验收和改状态,AI 最多调度任务池。
- Claude Code 并行代理:官方路径是子代理、代理视图、团队、动态工作流;会改同一文件时用 worktree 或按文件集拆分。
- Codex Agent Harness 套壳:同目录并行要目录锁或改串行;审批做在编排层。
Worktree、目录锁、冲突检测管的是文件交叉。合回来之后,人还是要一篇一篇验收。产品意图常常要看到半成品才临时改,截图对照描述推不出这个。
可执行做法
- 单会话:意图含糊时先问人,不要用推测填空后继续改仓库。
- 多会话:一次只跑互不重叠的模块,验收完再开下一批。
- 锁、冲突检测、worktree 用来防交叉改文件,不当成验收方案。
- 调度可以交给 AI;验收、改状态、产品对不对仍由人做。
- 人离开会话时,更不该放开「按推测继续」。
与相关概念的关系
- Harness Engineering:harness 是执行环境;本页是这个环境上怎么跑任务循环。编排层的锁、审批、分批,是把工作流做成系统能力。
- Claude Code 常见工作流:官方产品里的提示模式、plan mode、会话恢复;本页是跨工具的编排问题。
- AI 辅助开发:架构取舍、验证与集成仍由人负责;Agent 工作流决定人在循环里出现的位置。
- AI 使用边界与提效反噬:自动续跑和无限并行都会把局部提效变成额度与注意力透支。
- 查询:AI编程和 Vibe Coding 的差异在哪:还管不管代码,决定这些节点能不能省。
综合结论
Agent 工作流要设计两件事:单会话何时停下来问人,多会话如何分批才对得上人的验收带宽。模型变强以后,更常见的失败不是它停住问人,而是它不问就干、干完人验收不过来。
维护:Cursor Agent,2026-09-07。