2026 年 8 月 9 日,周日下午三点到五点,线上,第 85 期。 我又一次坐在主持人的位置上,桌上放两份材料:行为科学家 Jon Levy 的《Team Intelligence》, 和 Anthropic 2026 年 6 月的一篇博客《Building effective human-agent teams》。
一份回答「一群人怎样才算一个聪明的团队」,一份回答「当团队里出现 AI agent,该怎么带」。 它们不是两个话题,是一套理论的地基和房子。
从 2025 年 11 月第一场讲「怎么向 AI 提问」开始,这个房间里的 AI 话题一共走了五拍: 提问(技能)→ 人机分工(战略)→ 我自己的五个月(实践)→ 上一场问「人还剩下什么」→ 这一场问「我们怎么一起工作」。
上一场(第 80 期)结束时,我心里留了一个没接住的钩子。那场我们花了两个小时讨论 「一个人在 AI 时代靠什么活下来」,可散场时最强的感受是:这件事不是一个人的事。 所以这一场我把镜头从「我」摇到「我们」。
材料也换了性质。这一次不是两本讲 AI 的书,而是一本讲团队科学的书, 加一篇讲 AI 实操的博客。这份导读最初是为我自己研究人机协作而写的, 后来才成了读书会的分享材料。写的时候我给自己立了一条规矩:正文只做原文的忠实转述, 凡是我自己的解读,一律装进「导读注」明确标出,不与原文混淆。 这条规矩在现场救了我几次。
流行叙事说:找到明星领导 + 明星人才,成功自然发生。Levy 说证据是反的—— 工作中最小的生产力单位不是领导者,不是个人,是团队。
书的第一页就把证据摆上来。1980 年美国抵制莫斯科奥运,NBA 组织了 5 场表演赛: 全明星队对上落选奥运的大学生国家队。全明星队由刚率队夺冠的教练执教,怎么看都该碾压。 结果大学生队 5 战 4 胜,其中一场赢了 31 分,唯一输的那场只差 2 分。 反过来看 2004 年雅典奥运,拥有 LeBron、Wade、Anthony、Iverson 的美国队被波多黎各赢了 19 分, 最后勉强摘铜。天赋是入场券,但不足以赢。
更狠的证据来自鸡。进化生物学家 William Muir 做过一个产蛋实验: 一组是把产蛋量最高的「超级鸡」凑在一起,一组是整组挑选的普通鸡群。 一年后,超级团队那组大获全胜——而超级鸡那组只剩 3 只活着,其余全被同伴啄死了。 Levy 用它说一件事:你持续奖励什么,就会得到什么。而我们从少年队、从排名、从个人 KPI 一路走来, 大多数人都是被当成超级鸡养大的。
我在现场用的开场是书里引言的另一个实验:研究者给放射科医生看肺部扫描片, 右上肺明晃晃画了一只大猩猩——只有 17% 的医生看见了它。 这叫非注意盲视:大脑只看得见被训练去寻找的东西。 但关键在后半句:一旦你看见了那只大猩猩,就再也无法当它不存在。
所谓 team intelligence,是让一群人在一起时更聪明、更高效的那套技能、态度与习惯。 书把它拆成三根支柱,每一根都配了一个我在现场讲得最起劲的案例。
团队的推理能力不来自最聪明的那个人,来自五层对齐:指挥官意图(整个组织知道要达成什么)、 任务参数(这次结束时的终态长什么样)、团队目标、个人贡献, 以及最常被企业忽略的第五层——每个人自己想要的东西,和上面四层不冲突。
冷战给这条原理做过一场大型对照实验:苏联飞行员技术精湛,但依赖地面实时下令, 一旦战局脱离脚本就瘫痪;美国飞行员因为理解任务意图,可以当场自创替代方案。 意图先于战术。
1999 年《财富》把 LEGO 评为「二十世纪的玩具」;2003 年它亏损 3 亿美元,濒临破产。 它不缺 north star——它缺的是注意力。因为害怕孩子只爱电子游戏, 到 2003 年它把产品线扩张了三倍,一年闯进五个新领域,全部失败。
高智能团队的注意力机制里,最反直觉的一条叫 bursty communication(突发式沟通): 最高效的不是永远在沟通,也不是各干各的,而是密集的爆发 + 安静的独立工作交替。 底下托着它的是心理安全——而心理安全不等于一团和气: 高心理安全的团队冲突率反而更高,因为人们敢互相挑战想法。
2003 年 2 月的安特卫普钻石劫案:那片街区流转着全球约 80% 的毛坯钻, 金库有十层安保。一伙人连开 109 个保险箱,带走约一亿美元的钻石和现金, 警报从头到尾没响。靠的不是天才个体,是资源正确的团队—— 主谋擅长社会工程,队友的绰号就是能力清单:撬锁与电工、报警系统专家、顶级的钥匙锻造老者。
然后一个不胜任的成员毁掉一切:逃亡路上有人慌乱,把本该烧掉的证据丢在了路边。 一个不胜任的成员毁掉的,比一个超星建起来的更多。 资源支柱的正式定义是团队的记忆:成员知道什么、怎么思考、有什么本事——以及别人能否调取它。
三支柱要立得住,底下得有信任。而信任的配方,Levy 给的顺序和大多数人的直觉正好相反。
证据是三种「破口」的代价完全不同:一次搞砸演示(能力破口)会被当成状态不好,很快原谅; 一次说谎(诚实破口)很难翻篇;而善意破口最不可饶恕。 可我们开口就是专业度。
配套的最小动作叫「脆弱性循环」,只有五步:A 示弱(「我对这次演示很紧张,能给我点反馈吗」)→ B 回应 → B 以同等程度示弱 → A 致谢 → 双方确认「在这个深度是安全的」,信任升一级。 方向是关键:是脆弱先于信任,不是信任先于脆弱;领导要第一个示弱。 而如果有人示弱没被接住,信任会反向下跌。
博客写的是一家公司内部把 Claude 当「多人协作队员」用了几个月之后的四条经验。 它开头先划了一条线:过去我们用 AI 是「单人模式」——一个人、一个聊天窗口、一问一答; 而现在工作更像一场多人游戏:人类团队制定战略,AI 执行工作。 一个「配了聊天窗口的团队」和一个「有 agent 队员的团队」,分界在三个前提: 持久记忆、独立凭证、对组织信息的持续访问。三者缺一,agent 就还只是工具。
我在现场把这条落点当成整场的门轴:它不是「AI 时代要学新东西」,是「AI 时代旧东西不能再糊弄」。 顺着这条线往下推,还有一半是博客没展开的。
博客最后给了一份五问的体检单,我把它当成整场唯一的作业发了下去: 所有必要的信息和权限,是否都公开可搜索?你能不能写出完整的花名册——人和 agent 都在内—— 并且每项工作的归属清晰?每个成员手里的工具,是否与其职责匹配? 关键交付物有没有评分标准或测试可以验证?有没有一颗所有人都在引用的 north star?
如果这一场只带走一个数字,我希望是这一对。
他到 9 个下属之间的单向关系。这是绝大多数培训预算的落点。
10 个人之间全部的双向关系。而团队的大部分工作根本不经过领导。
83% 以「找出片子问题」为职业的专家,没看见那只画在片子上的大猩猩。
全球企业每年花在培训上的钱是 3900 到 5500 亿美元,其中约 400 亿花在领导力培训上。 哈佛肯尼迪学院的 Barbara Kellerman 研究后的结论是:几乎没有证据表明这些培训有任何长期效果—— 周末两天课学的新技巧,周一一遇到意外,人就缩回旧习惯了。 可笑的是,除了军队,几乎没有组织做「团队训练」。
Levy 给的替代方案不是再上一门课,而是把护栏造进系统。他自己那条规矩是: 任何事出错,第一句话先算我的错,因为流程是我设计的。 结果是他的团队报告问题飞快,没人怕他。
这一场我特意在开头说清楚:书是几十年行为科学研究的转述, 博客是一家公司内部实践的自述——它写的是「我们是怎么用的」,不是普适结论。 我把两者并排放,是因为它们互相印证;但如果要拿去改一支真实的团队, 该被当成证据的是书,该被当成样本的是博客。
书的最后一章用一个人的一生把全书装订起来:Draper Kauffman——瘦弱、高度近视, 海军学院毕业时因视力被拒绝授衔。后来他创办海军拆弹学校, 又创办水下爆破队,也就是海豹部队的前身;而当年拒绝他的那所学院,最终由他出任院长。 他做过的最关键的一个动作是:作为军官,和士兵一起从头受训。 一个动作同时证明了胜任、诚实和善意。
这也是我想让房间带走的那句话。当队友里坐进 AI agent,要守住的仍然是同一套团队科学: 对齐的推理、同步的注意力、显性化的资源,以及底下那层「善意排在能力前面」的信任。 混编不是一个新问题,它是一个老问题在新条件下的加压版本—— 所以在混编之前,先读懂团队。
这是这个系列的第十一场,也是暂时的句点。十一场下来,讲过提问、求职、大脑、钱、归属、 趋势、方法、吃饭、AI 工作台、AI 时代的个人生存,最后落在团队。 唯一没变的是那个句式——HOW TO ___。横线上的词,还会继续换。
本文是「HOW TO ___ · 读书会分享」系列的第 11 场(共 11 场),分享发生于 2026 年 8 月 9 日,内容整理自当时真实的分享材料。全系列按最初分享的时间排在 Ideas 时间线上。