← Gimbo's Universe / Ideas / 第一台自动机器
实操记录 · Claude Code · AI 学习记录 #04

我搭的第一台自动机器,
第一次就抓到了
我自己的错.

前三篇我都在做同一件事:读 Anthropic 的文章,然后给自己的 skill、舰队、循环打分。这一篇不一样——我真把学到的三样东西(skill / workflow / loop)焊进了一件天天要做的真事:我那份投资简报。给它加了两样它从来没有的东西:一道「交付前自查闸」,和一个专门唱反调的「红队」,再挂成本地周循环。然后我按下试跑。第一次运行,这台我亲手搭的机器,就当着我的面,抓到了我自己三个自欺。这是「把读到的变成能交出去的」,第一次真的闭上了环。

前情
AI 学习记录 #01–03(skill / workflow / loop)
标本
我舰队里的投资简报官
形式
动手焊 + 按下试跑 + 看它抓错

这次不是读,

前三篇连起来是同一台机器的三个零件,而且我给自己打分的结果高度一致:我擅长「生成」,不擅长「证伪」。skill 缺「坑」、舰队缺「唱反调的」、日常缺「一直转的循环」——全是「交出去」这一步没做够。诊断做完,总得有一次真的动手。我挑了最该升级的那件事,把三个零件一次焊上:

来自 #01 · Skill

一道交付闸

给简报加了一段「合格才准交」的自查清单:数据有没有标日期、每条结论有没有证据、有没有漏掉的部分。skill 补上了它最缺的自动 check。

来自 #02 · Workflow

一个红队

草稿出来后,换一副专门挑刺的眼睛再过一遍,逐条试着证伪:证据够吗?有没有偏袒我上一版的判断?这就是那篇里最缺的对抗式验证。

来自 #03 · Loop

挂成周循环

把它设成每周一次的本地循环(数据不上云,是原则)。「触发」为隐私故意留半手动——我升了一级,不贪四级。

注意:这三样加起来没让我写一行复杂代码——都是往那个 skill 的说明书里加了几段话。难的从来不是技术,是想清楚「一份合格的东西长什么样」「该从哪个角度拆自己的台」。焊完,我按下试跑。

一台机器,
当面拆我三次

这是这次最想给你看的东西。第一次跑,红队就在我的草稿里,揪出了三处我自己根本不会发现的自欺——因为它们太像「我平时就是这么想的」:

自欺 01 · 复读

我直接沿用了上周的一个判断

草稿里有个结论,我原封不动搬了上一版简报——感觉很对,因为那就是我上周的想法。红队一核:世界这周已经变了,那个判断早就不成立。这是最隐蔽的偷懒:偏袒自己的过去(self-preferential bias)。

红队改法:重新按本周现实推算,把那句「你已经怎样了」换成了「情况其实已经变成这样」。
自欺 02 · 越界

它差点催我做一件不可逆的事

草稿里有条建议,语气偏向催我立刻动手去做一个不可逆的操作。红队拿出我自己定过的纪律(有些大动作要挑时点、不可逆的事必须留给本人拍板)把它拦下:从「催你做」降级成「只起草方案,时点你自己定」。

红队改法:该我做主的地方,不许机器把我架上铁轨——它把决定权还给了我。
自欺 03 · 假装完整

我在没看全数据时就想下结论

有一块数据我其实没看全,但草稿读起来一副胸有成竹、结论完整的样子。红队逼我把「这块没看全 / 待核」明明白白标出来,不许用漂亮的完整感盖住窟窿。

红队改法:诚实优先于好看——一份承认自己缺了什么的简报,才是可信的。

诚实,
好看值钱

红队挑完刺,还有一道「交付闸」:合格标准全过才准交,否则如实标注、别硬撑。这次五条里四条干净通过,一条带着诚实的标注放行——而这一条,恰恰是它最该做的事。

交付闸 · 5 条自检结果

  • 数据都标了「截至日期」,拉不到的一律标「待核」,一个数都没编
  • 摘要压到三行内,点出「最该动的那一两件」
  • 每条建议都写全「做什么 + 为什么 + 需要我」,且不超过三条(宁可少而准)
  • 逐条对照过我自己定的硬规则,红旗都点了名
  • 有一块数据没看全 → 没有假装完整,老实标了「待核」放行。这不是失败,这正是交付闸存在的意义

升级前,这台机器会直接吐一份看着完整、其实复读了旧判断、还假装数据都看全了的简报——而我大概率会点头收下,因为它「读起来很对」。升级后,红队摁住三个自欺、交付闸逼它对缺口诚实。同一件事,产出从「自我确认」变成了「自我审视」。

我给自己,
造了一个诚实的对手.

复读上一版的判断、被催着做不可逆的事、在没看全时假装看全——这三个自欺根本不是投资独有的,是每个人每天做决定时都在犯的。过去唯一的区别是:没有任何人、任何机器会拦我。现在有了一个。它不比我聪明,它只是不偏袒我——而这恰恰是我最给不了自己的东西。

认知免费之后,
稀缺的不是再生成一版,
是有人说你错了.

我曾经在另一篇里招供过:我做的模拟都是「自己出题、自己阅卷」,断言必然通过。这台机器,就是我一直缺的那道「别自己给自己阅卷」。读(#01–03)→ 焊(交付闸+红队+循环)→ 跑(抓到三个错)——到这一篇,这一整圈才算真的闭上。学一样东西的终点,不是看懂,是它开始替你干活、还敢当面纠正你

下一步很简单:让它跑满几周,看它还能抓到我什么。这台机器越诚实,我就越自由。

—— 这是「AI 学习记录」的第 4 篇,也是 Anthropic 三件套(skill / workflow / loop)这个小系列的收官:从看懂,到跑起来。