把重复流程写成代码:agent workflow 固化实战
同一套多步骤流程用了第三次,就别再复制粘贴提示词了。这篇指南讲 workflow-as-code 的升级信号、四块设计积木(顺序并行/结构化交接/交叉校验/人工检查点),并手把手拆一个“发布检查”工作流——代码管流程、agent 管判断,外加三个反模式。

从"咒语收藏夹"到"流程代码"
每个 vibe coder 的收藏夹里都躺着几条反复用的提示词:上线前让 agent 跑一遍的检查清单、重构前必做的分析套路、每周一次的依赖健康扫描。它们好用,但有个致命伤——每次执行都是一次临场发挥。同样的清单,agent 今天跑 5 步,明天跑 7 步,后天漏了最关键的一步。
GitHub 刚发布的 Copilot Dynamic Workflows(本站昨日报道)把这件事推到了台前:流程可以写成代码。但别误会,这不是某个产品的专属功能,而是一种工程范式——把"怎么做"从 prompt 里抽出来,变成可版本管理、可 review、可测试的程序。这篇指南讲的,就是什么时候该升级、怎么设计、以及哪些坑别踩。

升级信号:同一流程用了第三次
判断标准很简单:同一个多步骤流程,你手动触发了第三次,就该考虑把它写成代码。第一次是探索,第二次是验证,第三次还在复制粘贴 prompt——你就是在用最贵的方式(你的注意力 + token)重复劳动。
典型的候选流程:发布前检查(跑测试→扫依赖→检查迁移→生成 changelog 草稿→停下来等人确认);新功能三件套(调研→写计划→实施→自测);PR 预检(并行 review 变更文件→跑相关测试→汇总风险点);定期巡检(每周扫一遍慢查询、过期依赖、安全公告)。
反过来,别急着固化的:只做过一次的流程(你还不知道正确步骤长什么样);高度依赖临场判断的任务("看看这段代码有没有问题"这种开放式问题);以及变化比执行更频繁的流程——写代码的成本还没收回来,流程已经变了。
设计模式:四块积木
一个好用的 agent workflow,不管用什么工具实现,都是四块积木的组合:
1. 顺序与并行。 有依赖关系的步骤串行(先调研再写计划),无依赖的并行(同时 review 5 个变更文件、同时查 3 个系统的日志)。并行不是为了炫技,是为了把 wall-clock 时间压下来——agent 的等待时间是你能感知到的最直接的成本。
2. 结构化交接。 阶段之间传的不是自然语言段落,而是结构化数据:调研阶段输出 JSON(风险点列表、影响文件清单),实施阶段按这个 JSON 干活。自然语言在阶段间传递会"漂移",结构化数据不会。这是 workflow-as-code 相对"一长串 prompt"最核心的优势。
3. 交叉校验。 让第二个 agent(或另一个模型)验证第一个的结论。官方例子很妙:找出已合并 PR 的未解决评论,让两个模型独立判断是否还成立,只有两者一致才上报。成本翻倍,但误报率下来的幅度通常值得——尤其在"要不要打扰人"的决策上。
4. 人工检查点。 在不可逆操作前暂停:发版前、删数据前、合主分支前。检查点的艺术在于位置——太密,人成了瓶颈;太疏,失去了意义。经验法则:只在"错了会疼"的地方设卡,其余放行。
写第一个 workflow:发布检查清单
拿最常见的"发布前检查"开刀,一个最小可用版本长这样:
步骤一(并行):agent A 跑全量测试并汇总失败;agent B 扫描依赖更新与安全公告;agent C 检查未执行的数据库迁移。三路并行,结果以结构化格式汇总。
步骤二(判断):代码根据汇总结果做分支——全绿,直接生成发布说明草稿;有失败,把失败分类(测试失败/依赖风险/迁移缺失)后暂停。
步骤三(检查点):暂停,把分类后的问题清单推给你。你看一眼,点"继续"或"打回修"。
步骤四(收尾):继续则打 tag、生成 changelog、发通知;打回则把问题清单喂给修复 agent,修完回到步骤一。
注意这个设计里代码负责流程、agent 负责判断的分工:分支、并行、暂停是代码的活;"这个测试失败严不严重"是 agent 的活。分工错了(比如让 agent 决定"要不要并行"),流程就回到了临场发挥。
三个反模式
反模式一:把判断也写死。 workflow 里出现"如果测试覆盖率低于 80% 就拒绝发布"这种硬编码阈值要小心——阈值是会过期的。更好的做法:让 agent 评估"这个覆盖率下降是否可接受",代码只负责"把评估结果送到检查点"。
反模式二:workflow 太长。 超过 7 个步骤的 workflow,维护成本会指数上升。拆成两个小的:一个负责"检查",一个负责"发布",中间用人来衔接。小 workflow 之间用人工检查点连接,比一个巨型 workflow 更健壮。
反模式三:没有"逃生舱"。 每个 workflow 都要有手动接管的入口——某一步 agent 卡住了,人能直接执行那一步并让流程继续。没有逃生舱的自动化,第一次异常就会变成生产事故。
一句话总结
prompt 是"我希望你怎么做",workflow 是"必须这么做"。当你的 vibe 项目从"做出来"走向"稳定交付",把重复流程写成代码,是从手工作坊升级到流水线的那一步。先从那条用了三次的清单开始——今晚就可以。
相关文章

10 月 3 日,工程师 Kevin Liao 发表檄文冲上 HN 前页:记忆插件是一场 RAG 片段抽奖,Agent 需要的是文档工作区。本文拆解他的诊断、开源的 Operator Memory 插件、两个最强的反方质疑,以及今晚就能开始的最小实践。

Gergely Orosz 走访 OpenAI、Anthropic、Cursor、Ramp 后写下的 2026 行业现状:近 100% 代码由 AI 生成、Agent PR 八个月涨近 10 倍、code review 沦为表演、IDE 被判为遗产产品。本文提炼报告要点,并给出 vibe coder 的三个判断与四件本周可做的事。

10 月 3 日,Sites in ChatGPT 以约 209 点赞、218 评论冲上 HN 前页。这不是发布,而是一场清算:提示词直达 URL,到底是玩具、原型托管,还是生产力?四个争论焦点、文档实锤的技术事实(D1/R2、登录、自定义域名),以及给 vibe coder 的三个判断。