多 Agent 协作工作流的核心不是"同时用更多 Agent",而是把一条营销流水线拆成阶段,明确规定每个阶段由哪个 Agent 负责、拿什么输入、交出什么输出、在哪个人工关卡停下等批准。没有这套约定,多个 Agent 只是在各自的窗口里各干各的,最后还得人肉拼接。一个能稳定跑起来的最小版本,只需要两个 Agent、一个共享文件夹和一个审批点,下面把完整方案拆开讲。
触发与最终产物
先给这条工作流一个具体的样子,避免讨论停留在概念上。示例场景:一个面向中文营销从业者的内容站,每周需要把一批选题变成已发布并附监测记录的文章。触发条件是每周一选题清单就绪;最终产物是五篇通过人工审核、已发布到 CMS、并进入引用监测记录的文章。整个流水线跨调研、写作、校验、发布、监测五个阶段——这正是单个 Agent 很难独占完成的链路,也是多 Agent 编排的价值所在。
编排表:谁在哪个阶段做什么

编排表是多 Agent 工作流的骨架。每个阶段一行,写清负责的 Agent、输入、输出和人工关卡。下表按 VibeMKT Hub 的 Agent 定位给出一个可参考的分工。
| 阶段 | 负责 Agent | 输入 | 输出 | 人工关卡 |
| 选题与调研 | Claude Code(按上下文加载 Skill,执行复杂任务) | 选题清单、词表、参考资料 | 每篇的任务卡:主关键词、意图、角度、结构签名 | 确认任务卡 |
| 初稿写作 | WorkBuddy(自然语言操作办公环境) | 任务卡、写作规范文件 | 结构化草稿文件 | 无(抽检) |
| 数据与格式校验 | Codex(结合本地文件、数据与脚本) | 草稿文件、校验清单 | 校验报告:格式、字数、禁用词、来源标注 | 处理校验不通过项 |
| 发布执行 | Hermes Agent(URL 安装 Skill,处理长周期任务) | 终稿、发布配置 | 发布结果回执与文章链接 | 发布前终审 |
| 站点与项目持续推进 | ZCode(GLM 长上下文,持续推进网站与数据项目) | 发布记录、监测数据 | 周度汇总:收录、引用、异常清单 | 复盘决策 |
这张表不追求把所有 Agent 都排进去。选人的原则是任务匹配而不是名气:需要长上下文持续跟进的项目交给擅长持续推进的 Agent,需要跑脚本做批量校验的交给和本地数据、脚本结合紧密的 Agent。TRAE 这类承接调研到落地页、程序化 SEO 延伸任务的 Agent,适合在流水线扩展到页面生成时再引入;OpenClaw 这类聚焦本地文件与命令行的 Agent,适合承担文件整理与批处理环节。每个 Agent 用在它定位匹配的位置,比追求全家桶更重要。
数据怎么在 Agent 之间传递
多 Agent 协作失败最常见的位置不在某个 Agent 内部,而在两次交接之间。约定三条传递规则,成本最低、收益最大。
- 一切通过文件:每个阶段的产物落成带命名的文件(如“任务卡-关键词-日期”),放在共享的批次文件夹里。文件是所有 Agent 都能读写的最大公约数,也天然留下审计痕迹。
- 输入输出有契约:下游需要什么字段,上游就必须交什么字段。任务卡缺“搜索意图”,写作阶段就会跑偏;终稿缺 SEO 字段,发布阶段就要返工。契约写进每个阶段的说明文件,而不是靠记忆。
- 中间产物不跳关:下游只处理已通过上游关卡的文件,避免拿着未确认的任务卡写出五篇要重写的稿子。
人工关卡设在哪
关卡不是越多越好,每个关卡都会增加等待时间。三条判断标准帮你在编排表里放对位置:影响大且不可逆的操作之前必须设关,如对外发布、批量写外部系统;品牌与事实风险高的产物必须设关,如对外口径、数据引用、案例描述;首次运行的新阶段必须设关,稳定后再降级为抽检。按这三条,示例流水线的四个关卡里,“初稿后抽检”在运行稳定后可以从逐篇检查降为按比例抽查,但“发布前终审”永远保留——这是自动发布失控风险的最后闸门。
失败、重试与回滚
多 Agent 链路里,失败会被放大:一个环节的错误输出会成为下一环节的输入。处理原则按严重程度分三档。轻微失败(如某篇校验不通过):仅该篇打回上游重做,批次其余部分照常推进,不要因为一篇卡住整批。阶段失败(如发布接口连续报错):停止该阶段,保留已完成阶段的文件,记录失败现场,由人判断是重试还是换通道,瞬时网络类错误最多自动重试一次。方向失败(如抽检发现整批角度跑偏):停止下游一切动作,回到任务卡阶段修正,已产出的中间文件归档留档,不在错误方向上继续加工。回滚的前提是文件化:因为每个阶段的产物都是文件,回滚等于把指针退回某个阶段的目录,这正是坚持文件传递的第二个理由。
用什么指标判断工作流在变好
工作流本身也需要测量,否则只是流程更热闹。四类指标够用:效率类,从选题就绪到发布的周期时长、人工介入次数;质量类,终审一次通过率、发布后修正次数;风险类,关卡拦截次数与拦截原因分布;结果类,产出内容带来的收录与引用变化。每月看一次趋势,重点看人工介入次数的下降是否伴随一次通过率的稳定——效率提升而质量下滑,说明关卡降级降早了。
最小可行版本与扩展路径
不要第一天就上五个 Agent。最小可行版本是:一个写作 Agent 加一个校验或发布 Agent,一个批次文件夹,一个发布前审批点,先跑两三周把文件命名、输入契约和关卡规则磨合稳定。之后按痛点扩展:批量校验成为瓶颈就引入擅长脚本与数据的 Agent,发布频次上升就把长周期发布交给可挂 Skill 持续运行的 Agent,需要页面级产出再引入承接落地页与程序化 SEO 任务的 Agent。每次只扩一个阶段,扩完观察一个周期。
从 Vibe Marketing 的运行链路看,多 Agent 协作改变的是"编排与分发"这一环的承载力:人把方向、契约和关卡定清楚,Agent 群把执行吞吐提上来,测量数据再反过来修订编排表。如果你正准备搭第一条多 Agent 流水线,从上面那个两 Agent 的最小版本开始,比一开始就设计宏大架构更快见到真实反馈。
可以直接使用的工具
如果你准备照着本文做一遍,可以从下面选择适合当前任务的一项。