返回探索
指南VibeFix 编辑部更新于 2026年10月7日

把重复流程写成代码:agent workflow 固化实战

同一套多步骤流程用了第三次,就别再复制粘贴提示词了。这篇指南讲 workflow-as-code 的升级信号、四块设计积木(顺序并行/结构化交接/交叉校验/人工检查点),并手把手拆一个“发布检查”工作流——代码管流程、agent 管判断,外加三个反模式。

深色工作流画布:Trigger、Prompt 与 AI 模型节点组成的自动化流程

从"咒语收藏夹"到"流程代码"

每个 vibe coder 的收藏夹里都躺着几条反复用的提示词:上线前让 agent 跑一遍的检查清单、重构前必做的分析套路、每周一次的依赖健康扫描。它们好用,但有个致命伤——每次执行都是一次临场发挥。同样的清单,agent 今天跑 5 步,明天跑 7 步,后天漏了最关键的一步。

GitHub 刚发布的 Copilot Dynamic Workflows(本站昨日报道)把这件事推到了台前:流程可以写成代码。但别误会,这不是某个产品的专属功能,而是一种工程范式——把"怎么做"从 prompt 里抽出来,变成可版本管理、可 review、可测试的程序。这篇指南讲的,就是什么时候该升级、怎么设计、以及哪些坑别踩。

工作流画布:Trigger、Prompt、AI Agent 节点组成的自动化流程

升级信号:同一流程用了第三次

判断标准很简单:同一个多步骤流程,你手动触发了第三次,就该考虑把它写成代码。第一次是探索,第二次是验证,第三次还在复制粘贴 prompt——你就是在用最贵的方式(你的注意力 + token)重复劳动。

典型的候选流程:发布前检查(跑测试→扫依赖→检查迁移→生成 changelog 草稿→停下来等人确认);新功能三件套(调研→写计划→实施→自测);PR 预检(并行 review 变更文件→跑相关测试→汇总风险点);定期巡检(每周扫一遍慢查询、过期依赖、安全公告)。

反过来,别急着固化的:只做过一次的流程(你还不知道正确步骤长什么样);高度依赖临场判断的任务("看看这段代码有没有问题"这种开放式问题);以及变化比执行更频繁的流程——写代码的成本还没收回来,流程已经变了。

设计模式:四块积木

一个好用的 agent workflow,不管用什么工具实现,都是四块积木的组合:

1. 顺序与并行。 有依赖关系的步骤串行(先调研再写计划),无依赖的并行(同时 review 5 个变更文件、同时查 3 个系统的日志)。并行不是为了炫技,是为了把 wall-clock 时间压下来——agent 的等待时间是你能感知到的最直接的成本。

2. 结构化交接。 阶段之间传的不是自然语言段落,而是结构化数据:调研阶段输出 JSON(风险点列表、影响文件清单),实施阶段按这个 JSON 干活。自然语言在阶段间传递会"漂移",结构化数据不会。这是 workflow-as-code 相对"一长串 prompt"最核心的优势。

3. 交叉校验。 让第二个 agent(或另一个模型)验证第一个的结论。官方例子很妙:找出已合并 PR 的未解决评论,让两个模型独立判断是否还成立,只有两者一致才上报。成本翻倍,但误报率下来的幅度通常值得——尤其在"要不要打扰人"的决策上。

4. 人工检查点。 在不可逆操作前暂停:发版前、删数据前、合主分支前。检查点的艺术在于位置——太密,人成了瓶颈;太疏,失去了意义。经验法则:只在"错了会疼"的地方设卡,其余放行。

写第一个 workflow:发布检查清单

拿最常见的"发布前检查"开刀,一个最小可用版本长这样:

步骤一(并行):agent A 跑全量测试并汇总失败;agent B 扫描依赖更新与安全公告;agent C 检查未执行的数据库迁移。三路并行,结果以结构化格式汇总。

步骤二(判断):代码根据汇总结果做分支——全绿,直接生成发布说明草稿;有失败,把失败分类(测试失败/依赖风险/迁移缺失)后暂停。

步骤三(检查点):暂停,把分类后的问题清单推给你。你看一眼,点"继续"或"打回修"。

步骤四(收尾):继续则打 tag、生成 changelog、发通知;打回则把问题清单喂给修复 agent,修完回到步骤一。

注意这个设计里代码负责流程、agent 负责判断的分工:分支、并行、暂停是代码的活;"这个测试失败严不严重"是 agent 的活。分工错了(比如让 agent 决定"要不要并行"),流程就回到了临场发挥。

三个反模式

反模式一:把判断也写死。 workflow 里出现"如果测试覆盖率低于 80% 就拒绝发布"这种硬编码阈值要小心——阈值是会过期的。更好的做法:让 agent 评估"这个覆盖率下降是否可接受",代码只负责"把评估结果送到检查点"。

反模式二:workflow 太长。 超过 7 个步骤的 workflow,维护成本会指数上升。拆成两个小的:一个负责"检查",一个负责"发布",中间用人来衔接。小 workflow 之间用人工检查点连接,比一个巨型 workflow 更健壮。

反模式三:没有"逃生舱"。 每个 workflow 都要有手动接管的入口——某一步 agent 卡住了,人能直接执行那一步并让流程继续。没有逃生舱的自动化,第一次异常就会变成生产事故。

一句话总结

prompt 是"我希望你怎么做",workflow 是"必须这么做"。当你的 vibe 项目从"做出来"走向"稳定交付",把重复流程写成代码,是从手工作坊升级到流水线的那一步。先从那条用了三次的清单开始——今晚就可以。

浏览项目广场发布你的项目

相关文章

笔记本电脑屏幕上显示着浏览器中的网站注册页面
资讯
ChatGPT Sites 冲上 HN 热榜:提示词建站,到底是玩具还是生产力?

10 月 3 日,Sites in ChatGPT 以约 209 点赞、218 评论冲上 HN 前页。这不是发布,而是一场清算:提示词直达 URL,到底是玩具、原型托管,还是生产力?四个争论焦点、文档实锤的技术事实(D1/R2、登录、自定义域名),以及给 vibe coder 的三个判断。

AI 编程实践产品发布独立开发