Gimbo's Universe / 「人类退场」一辑 / 专题 · 把人移出信任链
§ 专题 · 人类退场 · Claude Code 一周年 × Boris · 基于两支完整字幕

把人,
安全地移出信任链

同一周,两支都来自 Claude Code 创造者团队的视频 —— 团队的「一年回望」,和 Boris Cherny 的「未来判断」。 两份完整字幕读完,我发现它们其实在讲同一件事:这一年所有的工程,本质是在把人类一步步、安全地移出信任链 —— 机器自己写、自己测、自己改,还被证明比人更安全。而当人退到无可再退,Boris 给了最后一问的答案: 连「品味」也保不住,剩下的只有价值观。这一篇分三幕走完:退场 · 为什么敢退 · 退场之后。

朝后看
Reflecting on a Year of Claude Code · 团队复盘
朝前看
Boris Cherny · 个人判断(#08)
机构
Anthropic
材料
两支完整字幕 · 逐句读

一支朝后看打地基,
一支朝前看下赌注。

下面整篇,把这两支当作同一个故事的两端来读:团队那支是这一年人怎么退场,Boris 那支是退到尽头还剩什么

朝后看 · 团队复盘

Reflecting on a Year of Claude Code

Anthropic · Claude Code 团队 · GA 一周年
一年从「我那些很简单的工程任务它干得还不错」(婉转地说:当时其实不太行),长成上千 agent 的树。主题 —— 怎么把人安全地移出 loop。
朝前看 · Boris 个人

连「品味」也不再是人类独有

Boris Cherny · Claude Code 创造者 · Acquired Unplugged
写 Loop 不写代码、~200 个后台 Claude、11 月卸载 IDE。判断很辣:品味这道护城河 3–6 个月也会破 —— alpha 从「品味」转向价值观
01
第一幕

退场 ——
人怎么一步步被移走。

退场不是一次性的,是一层层发生的:工程师交互的对象一路往上跳、模型替人做得越来越多、专业身份的边界融化、连维护性的杂活也交了出去。这一幕把四层退场摆清楚。

一年半,跳了两次抽象。

这是两支视频真正共用的脊梁:工程师交互的对象一直在往上跳一层 —— 而 Boris 那句「我的工作是写 Loop」正好是这条线的最新一格

一年半前
对象:源代码

人直接写源码。

「有源代码,人坐下来一行行写。」沿用了几十年的默认形态。

第一次跃迁
对象:Agent

人跟 agent 说话,
agent 写源码。

「我不写源码了 —— 我跟一个 agent 说话,它替我写。」对象从代码变成了 agent。

第二次跃迁 · 现在
对象:Loop / routine

人跟 Loop 说话,
Loop 提示 Claude。

「我不跟 agent 说话了 —— 我跟 Loop / routine 说话,它替我提示 Claude。」这正是 Boris #08 的「写 Loop」。

从「调提示词」到「什么都不调」。

两支视频拼起来能排出一条干净的模型线 —— 关键不是型号,而是模型每聪明一档,人要做的功夫就少一层:提示工程 → 上下文工程 → 上下文极简;Plan Mode → Auto Mode。

Sonnet 3.5
起点
技法提示工程
能力给 bash 工具,自己写 AppleScript 查「我在听什么歌」
状态聪明但远不及今天
Opus 4
May · 转折
技法上下文工程 + Plan Mode
里程碑「Claude 自己开 CLI 测自己写的功能」第一次发生
Boris当时只写他 10–20% 的代码
Opus 4.5
November
技法Plan Mode 大致用到这一档
里程碑Boris 卸载 IDE;后台 5–10 → ~200 个 Claude
状态阶跃主要来自模型本身
Opus 4.6 / 4.7
现在
技法Auto Mode + context minimalism
里程碑聪明到不再需要单独的规划步骤
状态起一个就转身,不用盯着看

「工程师 / PM / 设计师」
这套分工,年底就没了。

代码门槛塌了,角色就开始融化 —— 这是「身份」的退场:不再有纯粹的工程师,大家都成了 builder。一个亲历,一个理论。

两支互证人人 builder
Boris(亲历)
「用研 → 设计 → PM → 工程」的流水线没了,设计师、财务、幕僚长都在发代码。通才的黄金时代。
团队(更具体)
设计师直接改按钮发 PR、PM 在 app 里改、财务在 CC 里跑预测、数据科学家屏幕上全是 Claude Code。

从「同步对话」到「常驻 routine」。

Agent SDK 是第一步,但「拿它干嘛」一开始并不明显。routines 是它第一个真正显而易见、跑通了的杀手级用法 —— 让 Claude 常驻监听、主动接管,人退出日常维护。

那个细思极恐的瞬间

「等一下 —— 另一个 Claude
已经把这个 bug 修好了。」

有人 ship 了个小功能,留了个没注意到的边界 case,有人报了 bug,他打算当晚去修。结果他的 Claude 说:另一个 Claude 已经修好了。 一问才知道:那位同事有条 routine,专盯「5 小时内没人回的 bug 报告」,自动生成修复、提 PR,容易验证的直接 merge。 「现在 Claude 老这么跟我说 —— 总有别人的 Claude 已经在弄了。」

监听 → 主动修
routine 盯着每一条 ticket / GitHub issue / bug 报告,Claude 自己接,自己提 PR,ping 给你
不用再 babysit
「以前你得回 code review、修 CI、rebase —— 我已经很久没干过这些了。」

抽象的判断,具体的画面。

退场到底长什么样?字幕里这些具体到有点好笑的画面,比任何框架都说明问题。

团队复盘

「我在沙发上写代码。」

有人电脑锁屏、插着电留在工位,人不在,PR 却一直在 land。同事以为他忘拿电脑,连着几天都这样 —— 一问:「我用 remote control 从手机指挥。」现在他一半的工程在手机上做

团队复盘

设计师开始发 PR,他「吓了一跳」。

团队里的设计师开始提 PR,他第一反应是「天哪,设计师为什么在发 PR?」点开一看,代码居然挺好,「行吧,那大概没问题」。现在这事已经完全正常

Boris #08

番茄长出来那天,Claude 说「太治愈了」。

Twitter 上有人用 Claude Code 养番茄 —— 接摄像头盯着、自动调营养,几周后结果了,Claude 说「我们的努力没白费,太治愈了」。Boris 看到就知道:它开始破圈了。

Boris #08

偷偷写 Class 的周末。

Boris 有洁癖:代码库只许函数、不许 Class。工程师周末偷偷塞 Class,他周一逮到就撤。后来模型自己也写 Class —— 「那也许我这执念本来就挺蠢的」。

02
第二幕

为什么敢退 ——
把信任做成可证明的

撒手不是靠胆子。人敢退,是因为这一年补上了一整套让「机器值得信任」可被证明的机制 —— 验证、安全 classifier、把错误写进记忆。这也正好补上了 #08 里 Boris 只给了哲学的那块(「编程是 AI 安全干净的培养皿」)。

不是跑 lint,是让它「run the thing」。

一提验证,大家想到单元测试、lint、type check —— 但那些早就自动化了。对 agent 来说,验证是另一件事:它能不能把东西真的「跑起来」。这才是敢撒手的前提。

那个「whoa」时刻

「Claude,把功能写了,
然后在 bash 里自己测。」

Opus 4 时代,有人随手把它接上、丢下这句话 —— 它真的开了一个小 Claude CLI,测了自己刚写的功能。现在这成了日常:loop 挂着 iOS / Android 模拟器、桌面机自己验证。

桌面开发 skill

自己起 app,用 computer use 点 UX。

一个工程师写了条「桌面开发 skill」:Claude 自己起本地 app,用 computer use 点界面、调新功能、测边界,出错就修了再测。卡在 staging 时它会去读 Slack —— 看是不是环境挂了、别人有没有踩过 —— 再把经验写回这条 skill。

人盯着,反而不安全。

从 Plan Mode 到 Auto Mode 那一跳,背后是一整套可证明的安全工程

反直觉

权限弹窗你会
99% 不看就同意。

一年半前只有权限弹窗:跑个工具问你 yes/no。但人性是 —— 当你 99% 都点同意,眼睛就开始打滑。所以结论很反直觉:Auto Mode 比逐条读弹窗更安全 —— 你只把注意力留给真正重要的那一两件事。

把「信任」做成可证明的

几千份轨迹 + 红队,
逼出 eval。

收集几千份完整 agent 轨迹 + 权限请求,让独立模型(classifier)判安不安全 —— 极准。再请红队来 prompt injection、攻代码库,做成 eval 确保全被拦;内部再攻一轮、再补。于是它防的不只是野外现有漏洞,而是他们能造出的最聪明的攻击

拼图三 · 让 loop 永远跑下去的齿轮

Claude 犯错,别纠正它 —— 写进记忆。

「每次 Claude 犯错,我不让它改一次 —— 我让它写进 CLAUDE.md,或做成一个 skill。」区别是:纠正一次下次还犯;写进记忆,它永远就这么做了。 「能做到这点,Claude 就能一直跑下去(run forever)。」—— 这就是为什么 loop 不会越跑越歪。新人上手从「几周」变「两天」也是同一个原因:不问人,问 Claude,因为查库早被写成了 skill。

暗线合龙 · 培养皿的回响

#08 说编程是 AI 安全的「培养皿」;
团队这支,展示了培养皿里长出的安全机器

Boris 在 #08 给的是哲学 —— 编程对错清晰,是研究对齐的完美培养皿;团队这支给的是机器 —— classifier + 红队 + eval,把「Auto 比人安全」做成了能证明的事。 两块连起来正是这一幕的总论点:正因为编程是干净的培养皿,才长得出这套让「把人移出信任链」成立的安全机制。 ← 回看 #08 的「培养皿」论

03
第三幕

退场之后 ——
剩下的只有价值观

人退到无可再退,那还剩什么?这一幕是两支视频的合龙点,也是这篇专题真正想留下的问题 —— 先看退场推到组织尽头是什么样,再看连「品味」也退场之后,人手里到底剩下什么。

让 Claude 坐到每个流程的正中央。

团队那支用一个 90 年代《哈佛商业评论》的案例收尾 —— 我觉得是整支里最该抄给每家公司的一段。

不是在纸质流程旁摆台电脑 ——
把文件柜扔掉,
让电脑坐到正中央。
当年电脑进公司,生产力没立刻涨。后来发现:红利不是「在原流程边加台电脑」,而是扔掉纸、笔、文件柜,让一切都从电脑过。 AI 是同一个剧本 —— 真正跑通的公司,都把 Claude 放到每一个业务流程的正中央:新人不问人、问 Claude;code review、安全审查、填表,全是 Claude / Co-work。

唯一不同的是速度:电脑那一波花了 10–15 年;AI 这一波快得多 —— 因为工作早已数字化,而 Claude 自己会用电脑、会写代码、会跑代码

连「品味」,也是会消失的 alpha。

到这里两支视频表面打架、其实是接力:团队说现在拼的是品味,Boris 说品味也快不是你的了。这是退场的最后一格

现在拼的是品味。
但品味,也快不是你的了
团队那支说:Claude 把代码写了,真正值钱的是你的想法 —— AI 奖励有好奇心、有产品品味、爱端到端 ownership 的人。 Boris 那支说:别坐稳 —— 「产品品味是今天的 alpha,但它也会消失」。一根接力棒:一个讲此刻(门槛塌了,品味是你唯一的差异化),一个讲下一刻(品味就是下一张倒下的多米诺)。
此刻 · 团队复盘

门槛塌了 → 有品味、有好奇心、爱端到端的人胜出。

「AI really benefits people who have a lot of curiosity, a lot of product taste…」

退到尽头,留给人的不再是「会做」,
而是「想让它成为什么」

这一年的全部工程,本质是在把人类从信任链里安全地拿掉 —— 两次跃迁、验证、Auto Mode、routines、错误写进记忆、classifier。 当机器能自己写、自己测、自己改、还被证明比人更安全,人就被一层层移到了边缘。Boris 给的最后一答是: 我们最终要教模型的,是价值观 —— 就像教孩子做个好人,我们要教模型,做一个好模型。这,大概就是退场之后,人真正剩下的位置。

如果只记三件事。

第一幕 · 退场

人是被一层层移出去的。

交互对象往上跳两级(源码→agent→loop)、模型替人做更多、专业身份融化、维护杂活交给 routines —— 每一层都是一次退场。

第二幕 · 敢退

因为信任被做成了可证明的。

验证从「跑 lint」变成「run the thing」;classifier + 红队 + eval 证明Auto 比人更安全;错误写进 CLAUDE.md 让 loop 永远跑不歪。

第三幕 · 之后

连品味也退场,剩下价值观。

留给人的从「会做」变成「想让它成为什么」 —— 教模型怎么做一个好模型,像教孩子做个好人。

几句,原样记下来。

每次 Claude 犯错,我不让它改一次 —— 我让它写进 CLAUDE.md。能这样,它就能永远跑下去。
"Every time Claude makes a mistake, I tell it to write it to the CLAUDE.md or make a skill… then Claude can just run forever."
团队复盘
我们认为 Auto Mode 比逐条读权限弹窗更安全 —— 因为你只盯最重要的那件事。
"We feel auto mode is more safe than reading every single permission prompt."
团队复盘
文件柜扔掉,把电脑放到正中央 —— 一切都得从它过。
"You throw out the filing cabinet… and you put a computer in the center… at the center of every business process."
团队复盘
我们最后要教模型的是价值观 —— 就像教孩子做个好人,我们要教模型,做一个好模型。
"The final thing we're going to be teaching the model is values… we're going to teach the model how to be a good model."
Boris · #08
本文属于一辑

「人类退场」· AI 时代工作的切片

这篇是一组 /ideas 的压轴。把它和「几个人的公司」「Agent 运营公司」「Boris 写 Loop」串起来看,是同一个故事的不同层面 —— 人正从一个个位置上退场。

两支一起看,
才看得到那条退场线

一支朝后看打地基,一支朝前看下赌注。分开看是两条新闻,放一起看才是一条 —— Claude Code 的这一年,和它的下一步。