前三篇我都在做同一件事:读 Anthropic 的文章,然后给自己的 skill、舰队、循环打分。这一篇不一样——我真把学到的三样东西(skill / workflow / loop)焊进了一件天天要做的真事:我那份投资简报。给它加了两样它从来没有的东西:一道「交付前自查闸」,和一个专门唱反调的「红队」,再挂成本地周循环。然后我按下试跑。第一次运行,这台我亲手搭的机器,就当着我的面,抓到了我自己三个自欺。这是「把读到的变成能交出去的」,第一次真的闭上了环。
前三篇连起来是同一台机器的三个零件,而且我给自己打分的结果高度一致:我擅长「生成」,不擅长「证伪」。skill 缺「坑」、舰队缺「唱反调的」、日常缺「一直转的循环」——全是「交出去」这一步没做够。诊断做完,总得有一次真的动手。我挑了最该升级的那件事,把三个零件一次焊上:
给简报加了一段「合格才准交」的自查清单:数据有没有标日期、每条结论有没有证据、有没有漏掉的部分。skill 补上了它最缺的自动 check。
草稿出来后,换一副专门挑刺的眼睛再过一遍,逐条试着证伪:证据够吗?有没有偏袒我上一版的判断?这就是那篇里最缺的对抗式验证。
把它设成每周一次的本地循环(数据不上云,是原则)。「触发」为隐私故意留半手动——我升了一级,不贪四级。
注意:这三样加起来没让我写一行复杂代码——都是往那个 skill 的说明书里加了几段话。难的从来不是技术,是想清楚「一份合格的东西长什么样」「该从哪个角度拆自己的台」。焊完,我按下试跑。
这是这次最想给你看的东西。第一次跑,红队就在我的草稿里,揪出了三处我自己根本不会发现的自欺——因为它们太像「我平时就是这么想的」:
草稿里有个结论,我原封不动搬了上一版简报——感觉很对,因为那就是我上周的想法。红队一核:世界这周已经变了,那个判断早就不成立。这是最隐蔽的偷懒:偏袒自己的过去(self-preferential bias)。
草稿里有条建议,语气偏向催我立刻动手去做一个不可逆的操作。红队拿出我自己定过的纪律(有些大动作要挑时点、不可逆的事必须留给本人拍板)把它拦下:从「催你做」降级成「只起草方案,时点你自己定」。
有一块数据我其实没看全,但草稿读起来一副胸有成竹、结论完整的样子。红队逼我把「这块没看全 / 待核」明明白白标出来,不许用漂亮的完整感盖住窟窿。
红队挑完刺,还有一道「交付闸」:合格标准全过才准交,否则如实标注、别硬撑。这次五条里四条干净通过,一条带着诚实的标注放行——而这一条,恰恰是它最该做的事。
升级前,这台机器会直接吐一份看着完整、其实复读了旧判断、还假装数据都看全了的简报——而我大概率会点头收下,因为它「读起来很对」。升级后,红队摁住三个自欺、交付闸逼它对缺口诚实。同一件事,产出从「自我确认」变成了「自我审视」。
我给自己,
造了一个诚实的对手.
复读上一版的判断、被催着做不可逆的事、在没看全时假装看全——这三个自欺根本不是投资独有的,是每个人每天做决定时都在犯的。过去唯一的区别是:没有任何人、任何机器会拦我。现在有了一个。它不比我聪明,它只是不偏袒我——而这恰恰是我最给不了自己的东西。
我曾经在另一篇里招供过:我做的模拟都是「自己出题、自己阅卷」,断言必然通过。这台机器,就是我一直缺的那道「别自己给自己阅卷」。读(#01–03)→ 焊(交付闸+红队+循环)→ 跑(抓到三个错)——到这一篇,这一整圈才算真的闭上。学一样东西的终点,不是看懂,是它开始替你干活、还敢当面纠正你。
下一步很简单:让它跑满几周,看它还能抓到我什么。这台机器越诚实,我就越自由。
—— 这是「AI 学习记录」的第 4 篇,也是 Anthropic 三件套(skill / workflow / loop)这个小系列的收官:从看懂,到跑起来。