← Gimbo's Universe / Ideas / 给 AI 舰队做体检
学习笔记 · Claude Code · AI 学习记录 #02

派活谁都会,
难的是不让 AI
自己批自己的卷.

Anthropic 出了个 dynamic workflows——让 Claude 自己写一段 JS,临时搭一套多智能体编排(他们叫 harness)去干一个特定任务。读的时候我一直点头:因为我早就手工搭了一个 harness——我的 AI 舰队,一个 Chief of Staff 派活给投资/营销/健康/进化几个专职 agent。文章点出用 workflow 要治的三个失败模式,其中一个我在《两次模拟》里亲口招供过:自己出题、自己阅卷。这篇,就是把这三个病和七个药方,对着我自己的舰队和供应链沙盘,量一遍。

原文
Anthropic · Thariq Shihipar & Sid Bidasaria · 2026.06.02
标本
我的 AI 舰队 + 供应链沙盘
形式
读原文 + 给自己打分 + 动手补

给每个任务,
临时搭一套班子

平时 Claude Code 用的是一套通用「班子」(harness),处理日常编程够用。dynamic workflow 是让它遇到复杂任务时,当场给自己写一套专用班子——用 JS 描述怎么分工:派几个子 agent、每个用什么模型、能不能各自开一个干净的工作区、断了能不能续跑。

关键区别:静态 workflow 是你预先写死的流程,通用但呆板;动态 workflow 是 Claude 针对手上这个任务现编的编排——Opus 4.8 才具备的能力。代价是:很烧 token。所以文章反复提醒:不是每个任务都要,先问一句「这真的需要更多算力吗?」大多数日常活儿,用不着五个评审员开会。

那什么时候值得动用一整套班子?文章给的理由很实在——它专治大模型干长活时的三个老毛病。而且靠的不是「提醒它别犯」,是靠把活拆给各自上下文干净的子 agent,从结构上让这些毛病发不出来:

病 01

偷懒

复杂多步的活干到一半,半路宣布「搞定了」,其实只做了一部分。(agentic laziness)

病 02 · 我招供过

自偏

需要验证时,偏袒自己产出的结果。自己出题自己阅卷,当然全对。(self-preferential bias)

病 03

跑偏

聊得越久,离最初的目标越远,忠诚度一点点流失。(goal drift)

七种把活
拆开干的姿势

文章给了七个可复用的编排 pattern。中间那个我单独高亮——它正是治「病 02·自偏」的药,也是我下面给自己打分时,扣分最狠的地方。

Pattern 01

Classify & Act分类再派

先判断这活是什么类型 / 要什么格式,再路由给对应的 agent。

Pattern 02

Fan-Out & Synthesize扇出再合并

拆成多个子任务并行干,再收口合并。合并那一步就是同步点。

Pattern 03 · 治自偏 ★

Adversarial Verification对抗式验证

另派专门挑刺的验证 agent,拿预设的评分标准去每个产出,防止过度自信。

Pattern 04

Generate & Filter多生成再筛

先造一堆候选方案,再按质量、去重、验证筛掉大部分。

Pattern 05

Tournament锦标赛

多个 agent 用不同思路做同一件事,两两对比、逐轮决出胜者。给 1000+ 项定性排名不爆上下文。

Pattern 06

Loop Until Done干到干净为止

不设固定轮数,一直派到满足停止条件(没有新发现 / 零报错)才停。

Pattern 07

Model Routing智能分级路由

先派个分类器摸清任务难度,再按难度派给对的模型(轻活 Sonnet,重活 Opus)。

我的舰队,
用了几个药方?

我的舰队本质就是一套手搭的 harness:一个 Chief of Staff 接到「盘一盘」,扇出给投资(CIO)、营销(CMO)、健康(CHO)、进化(EVO)几个专职 agent,再收口成一份 briefing。拿这七个 pattern 量下来,我惊讶地发现——我早就在用其中几个,只是没有名字。

Pattern
我用了吗
证据 / 缺口
Fan-Out & Synthesize · 扇出再合并
✓ 天天用
Chief of Staff 就是活的扇出-合并:一句「盘一盘」扇给 CIO/CMO/CHO,各自出简报,再收成一份 briefing。我搭它时根本不知道这有名字。
Classify & Act · 分类再派
✓ 用了
进化官 EVO 干的就是这个:把我读的 / 看的 / 听的分类,蒸馏出 so-what,再路由给对的格子(CIO / CMO / CHO / 工作)。
Model Routing · 智能分级路由
半分
手动做(重活切 Opus、轻活 Sonnet),但没让一个分类器自动摸难度再决定。这一步可以交出去。
Loop Until Done · 干到干净为止
半分
我有 /loop,信条也是「循环 > 派活」;但多是固定节奏,不是「干到没有新发现为止」的收敛式停止。
Generate & Filter / Tournament
✗ 基本没
我做方案通常一稿到底,很少「先造五个再筛」或让几个思路打锦标赛。省 token,但也少了多样性。
Adversarial Verification · 对抗式验证 ★
✗ 最大的洞
我的舰队全是「建设性」角色,没有一个专职唱反调、拆台的。供应链沙盘更甚——《两次模拟》我自己写过:邮件是我造的、规则是我定的、断言必然通过。这就是活生生的病 02。

打完这张表,结论和上一篇(给 Replen 打分)惊人地一致:我擅长「生成」,不擅长「证伪」。我的舰队会派活、会收口、会分类,唯独缺一个会诚实告诉我「这里错了」的角色。而文章把这个缺口的名字、和补它的标准套路,一起递到了我手上——对抗式验证

补上那个
专门拆台的角色

这一刀最值,而且好在——文章特意说了 workflow 不是只给大任务用的,你可以让它跑一个「quick workflow」,轻量地做一次对抗式审查。所以我不用建大工程,四步就能把这个洞补上:

Step 1 · 加个角色

给舰队添一个「红队 / 审卷官」

专职唱反调:CIO 出完投资简报,派一个只找反驳证据的 agent 去攻;方案定稿前,让它拿「投资人 / 客户 / 竞争对手」三个视角各挑一遍刺——文章原文就举了这个商业计划对抗评审的例子。

Step 2 · 治沙盘的自偏

让别人出题,别自己出题

供应链沙盘的断言之所以必然通过,是因为场景是我造的、还是干净的。补法:派一个 agent 专门造脏数据和边界场景(缺字段的邮件、前后矛盾的交期、超容差的发票)去攻我的 Action Center——攻不破,证据才算数。

Step 3 · 配上护栏

防偷懒、防跑偏、防烧钱

三个开关一起用:/goal 设硬性完成标准(治偷懒)、/loop 让它干到干净为止(治半途而废)、给个 token 预算(「用 10k tokens」)——毕竟 workflow 烧钱,别让红队自己失控。

Step 4 · 隔离不可信内容

「隔离区」:脏入口不给高权限

文章的 quarantine 套路,和我供应链 agent 的信条正好撞上:处理外部不可信邮件的 agent,绝不给它高权限操作——抽取归抽取,永远不许它直接发 PO、动付款。这一层我本来就信,现在有了名字。

四步里没有一步要我写复杂代码——最重的也就是一句「用 quick workflow,从投资人/客户/竞争对手三个视角对抗式审一下这个方案,预算 10k tokens」。把学到的就地用在自己的东西上,门槛比想象的低。

我一直靠直觉搭多智能体,
缺的是那个唱反调的.

这篇真正给我的,不是七个花哨的 pattern,是一面镜子:我手搭的舰队和供应链沙盘,擅长生成——派活、收口、分类样样行;却几乎没有证伪的能力。一个全是「好好先生」的班子,产出再多也只是自我确认。文章把我最缺的那块拼图,连名字带标准套路一起递了过来。

认知免费之后,
值钱的越来越是
「证伪」.

生成越来越便宜,谁都能让 AI 吐一堆方案。稀缺的是:有没有人——哪怕是另一个 agent——诚实地告诉你,这里错了。这和我那套 gimbo-perspective 的 gut-check 是同一句:「这能不能交出去?」对抗式验证,就是交出去之前的最后一道自查。上一篇教我给 skill 补「坑」,这一篇教我给舰队补「唱反调的人」——都是同一件事:把机器喂不出来的那部分,亲手补上。

下一步,我真的会给舰队加一个对抗 agent。这篇的下一篇,应该是它抓到我第一个错的那天。

—— 这是「AI 学习记录」的第 2 篇。看到什么、动手改了什么,都收在这里。