一只阿木木

90天,我试图让AI帮我搞清楚自己相信什么

90天,我试图让AI帮我搞清楚自己相信什么

——一份比我预期更难写的记录

这篇文章我写了三稿。

我试图写一份真实的复盘——不是「我用了这套系统然后变得更好了」,而是「我用了这套系统,以下是真实发生的事,包括那些我不确定该怎么解释的部分」。

如果你想要一篇让你感到「我也可以做到」的励志文章,这篇不是。

如果你想知道一个真实的人用了90天之后在想什么,继续读。


前言

2026年5月25日,我打开 /judgments/ 文件夹,数了一下:23个文件。

我的第一反应不是满足,而是困惑。

我花了90天,127次捕获,84次追问,试图搞清楚自己真正相信什么——最后得到了23个Markdown文件?

我坐在那里看着这些文件,想到一件事:

在开始这个系统之前,如果有人问我「你有几个核心判断」,我可能会随口说出十几个。

现在我知道答案是23个——但这23个是经过检验的。

问题是:那些我随口说出来的「十几个」去哪了?

它们大部分没有消失,只是变成了另一个东西:

有些变成了「听起来对但我没有真正相信的表述」——它们被过滤掉了。

有些变成了「我确实相信但还没想清楚为什么」——它们还在 /thoughts/ 里生长。

有些被追问之后,我发现我其实不相信——我只是觉得「我应该相信这个」。

最后那一类是最让我不舒服的发现。

关于「我应该相信这个」

第一个月,我捕获了一个想法:

text


1


AI时代最重要的能力是「提问能力」


我当时很喜欢这个想法。它符合时代叙事,听起来有洞见,是那种别人会点头的表述。

然后我用 /think 追问了自己。

第三轮追问里,Claude问我:

「你能举一个你亲身经历的、因为你的提问能力而产生了不同结果的例子吗?」

我坐在那里想了很久。

我想不出来。

不是因为这件事没有发生过——而是因为我从来没有认真想过「提问能力」到底是什么。我接受了这个词,觉得它说得对,然后把它装进了自己的「认知资产」里,从来没有追问过它。

那一刻有点难受。

不是那种「哦原来是错的」的清醒——而是一种更隐蔽的不舒服:我发现自己有一个习惯,把外部摄入的「听起来对的话」悄悄转换成「我的判断」,而自己完全没有察觉。

这个习惯在AI时代会被放大100倍。

因为AI每天生产的「听起来对的话」是无限的。你接触的越多,你就越容易把别人的框架当成自己的思考。

这是我开始这套系统的真正起点——不是「我想产出更多内容」,而是「我开始不确定哪些想法是我的了」。

第一个月:比想象中更孤独

我以为最难的部分是技术配置。

实际上最难的部分是:在被AI追问时,真正诚实地回答。

第二周,我捕获了一个想法:

text


1


深度工作的本质是对抗即时满足的能力


Claude问我:

「你说的『即时满足』——你自己最近一次选择即时满足而放弃深度工作是什么时候?」

我停下来了。

这个问题不难回答。难的是:我不想回答。

不是因为我没有例子。是因为我有太多例子,而且就在前一天——我在应该深度思考的时候打开了手机,刷了半小时没有任何记忆的内容。

我在文件里写了「用户放弃,下次继续」,然后关掉了Claude。

这件事让我意识到一个系统设计的根本局限:

你可以设计一套迫使你追问的系统。但你没办法设计一套迫使你诚实的系统。

诚实必须是你自己带进去的。

如果你带着「我想显得有深度」的心态使用这套系统,你会得到一批「看起来经过检验的判断」——但它们的本质还是表演。

追问是工具。工具能做的,是在你愿意诚实的时候,帮你更深入地诚实。

工具做不到的,是让你「想要诚实」。

第32天:困难期

有人问我,使用这套系统遇到的最大困难是什么。

我不想说「没有困难」,因为第31天到第45天我几乎没有使用它。

不是忘了,是选择不用。

那两周我处于一种很奇怪的状态:我知道系统在那里,我知道如果我打开它、捕获想法、开始追问,会有收获——但我就是不想。

不是懒。是一种更具体的东西。

那段时间我的工作压力很大,脑子里每天有几百件事在转。当我在这种状态下打开追问系统,我面对的第一个问题是:

「你说的『XX』具体是什么意思?」

然后我就很烦躁。

我知道这是L1澄清,我知道这是必要的——但有一种声音在说:我现在根本不想想清楚任何东西,我只想有人告诉我答案。

这是最诚实的描述:困难期不是「系统太难用」,而是「我没有认知带宽去承受被追问」。

这不是系统的缺陷,这是真实的人性——人的思考意愿是有起伏的,系统无法替你维持意愿的稳定。

我在这两周里转而用Claude做了很多「给答案」类的对话,感觉效率很高——但很快发现那些对话完全没有留下任何痕迹,第二天醒来什么都记不住。

第46天,我重新打开了 /think。

第一个问题又是那个:「具体是什么意思?」

我回答了。

3个被撤回的判断

我在这个系列的前面几篇里把「系统会修正错误判断」说得有点轻描淡写——好像只是一个正常的迭代过程。

真实体验是:一个你花了三周才建立起来的判断被推翻,会有一种很具体的自我怀疑感。

J-021是那个被朋友在对话中推翻的判断。

那次对话发生在4月下旬,在一个下午的咖啡馆里。朋友说:「你的判断只是换了一种方式说了一件大家都知道的事。」

我当时的第一反应是想反驳他。

我组织了半分钟的语言,准备说「不,你没有理解我的意思,我是说……」

然后我停下来了。

因为我意识到:我在反驳他的理由,是我自己也不太确信的理由。

回家之后,我打开判断档案,在进化记录里写了一行字:

text


1
2


2026-04-25:被反驳,论断边界不清晰,撤回重新追问
原因:在防御性反应中发现自己说不清楚


写这行字的时候有一种很微妙的感受——不完全是挫败,更像是一种奇怪的解脱。

原来「说不清楚」不只是一个认知状态,还是一个情绪信号。每次你在被追问时感到防御,通常是因为那个地方确实有一个你没有想透的漏洞。

这个发现本身后来变成了一个新的捕获:

text


1


防御心理是认知漏洞的报警器,不是论点质量的保护者


这个想法现在是 /thoughts/ 里成熟期的一个文件。还没结晶,因为我还在等一个更好的一句话表述。

真正改变了什么:一个具体的before/after

我不想用宏观的「变得更清晰了」来描述变化,因为这种表述和「用了X产品,生活更美好了」一样空洞。

我想说一个非常具体的事情。

90天前,有人问我:「你觉得AI会不会让人失去独立思考的能力?」

我的回答是:

「这是个很复杂的问题,一方面AI确实在提供便利,另一方面也有潜在的依赖风险,关键还是看使用方式……」

这个回答信息量是零。它只是把问题复述了一遍,然后用「看使用方式」逃掉了。

90天后,同一个问题。

我的回答是:

「我相信会。但不是以大多数人想象的方式失去。不是AI告诉你错误的答案让你变笨——而是AI太擅长给答案了,导致你越来越少练习「自己构建答案」这个过程。就像计算器不会让你变笨,但如果你从不做心算,你的心算能力会退化。判断力也是一种需要练习的肌肉,不是一种你拥有了就永远拥有的能力。」

「当然,这个判断有边界。如果你用AI的方式是『AI给视角,我做判断』,那判断肌肉反而可能在更高质量的追问中得到更多锻炼。所以失去的人,不是AI用得多的人,而是AI用得多但从来不问自己『我到底怎么想』的人。」

这不是我事先准备好的答案。

这是一个真实的对话,我当场说出来的。

区别在于:我这次说的话,有一条我能追溯的推理路径。我知道这个判断是从哪里来的,它经历过什么,它的边界在哪里。

这不是「变聪明了」。

这是「我知道我在说什么了」。

这两件事对我来说是完全不同的。

那23个判断档案:我真正想说的

我在这个系列前面把判断档案写得很工整——有支撑证据、有反驳、有边界条件。

这是真实的格式,但不是真实的体验。

真实的体验是这样的:

每一个判断档案背后,都有一次或多次这样的时刻——

我坐在那里,试图用一句话说清楚我相信什么,然后说出来之后发现说的不是我真正想说的,然后再试一次,然后发现还是不对,然后有时候我会有点绝望,觉得「算了,这个想法我就是说不清楚,可能它本来就是模糊的」。

然后在某一刻,不是刻意的,那句话就出来了。

J-014那个判断:「一个你说不清楚的想法,不是深刻,是未完成。」

我试了六次才说出这个版本。前五个版本分别是:

  1. 「模糊不等于深刻」(太短,没有说清楚为什么)
  2. 「感觉深刻的想法,大多数只是感觉」(有防御性,听起来在攻击别人)
  3. 「说不清楚的想法需要继续追问」(变成了方法论,不是判断)
  4. 「深刻和模糊是反义词」(太绝对,显然不成立)
  5. 「你说不清楚的,是还没完成的思考」(接近了,但「思考」这个词太宽)
  6. 「一个你说不清楚的想法,不是深刻,是未完成」(对了)

第六个版本出来的那一刻,我有一种很奇怪的感受——

不是「我终于想到了」,更像是「哦,原来这才是我一直想说的」。

好像这句话一直在那里,我只是把挡在前面的那些表述一层层剥掉,露出了它。

我不知道这是不是一种普遍的体验。但这是我的体验。

我一直在绕开的那个问题

写完前五稿,有一个问题我一直没有正面回答:

这套系统值得你花这些时间吗?

我的诚实答案是:这取决于你认为什么东西有价值。

如果你的衡量标准是:90天之后,我的内容产量有没有提升?

没有。甚至因为我花了更多时间「想」,花在「写」上的时间变少了,短期内产量是下降的。

如果你的标准是:我有没有更快速地获取信息和生成内容?

没有。这套系统在这方面毫无帮助,它甚至刻意地让你慢下来。

但如果你的标准是:

六个月后,你被人挑战你的某个观点时,你有没有能力在不防御、不崩溃的情况下,说清楚你为什么这么想,以及在什么情况下你可能是错的——

那这套系统,对我来说,值得。

不是因为它给了我答案,而是因为它给了我一套自己和自己对话的语言。

写到这里我想说一件事

前五篇文章我写得比较「完整」——架构、Skills、代码、设计决策。

这篇我一直想写得更「真实」,但写的过程里我发现,真实比完整难得多。

完整只需要你把所有信息组织好。

真实需要你愿意说那些说出来有点不好看的部分——比如那23天捕获为零、比如第32天开始的放弃期、比如被朋友推翻判断时的防御反应、比如那两个至今没有打开的「主动回避」文件。

但如果我不写这些,这篇文章就只是另一篇「我用了一个系统然后变好了」的内容,和我在这个系列一开始批评的那种「让AI替你思考」没有本质区别。

所以这是这篇文章本身的一个测试:

我能不能在写关于「诚实思考」的文章时,本身也保持诚实?

我希望我做到了。

至少比第一稿和第二稿更接近。


23个判断档案里,哪一个对我影响最大

有人问过我这个问题。

不是J-007(写得最完整的那个),不是J-014(结晶最快的那个),不是J-021(被撤回又重新结晶的那个)。

是J-023。

Markdown


1
2
3
4
5
6
7
8


---
id: J-023
statement: "判断力的退化是无声的——
           你感觉正常,但你已经不同了"
confidence: 0.83
created: 2026-04-19
crystallized: 2026-05-08
---


这个判断我几乎没有在任何地方公开谈过。不是因为它不成熟,而是因为它说的事情太让我不舒服,我不知道怎么处理。

它的核心支撑证据是一件很私人的事:

在使用这套系统的第60天,我翻出了我2024年写的一些文字。

我读了将近一个小时。

然后我发现了一件事:2024年的那些文字,在某些方面比我现在的文字更有生命力。

不是更准确,不是更深刻,但更鲜活——有更多从第一感受里长出来的东西,而不是从「这个观点是否经得起检验」里长出来的东西。

我花了很长时间思考这意味着什么。

最后我的判断是:

不是说那时候更好,而是说两种状态里有不同的东西在工作。

2024年的写作,是一个还不知道自己可能是错的人写的——所以他更勇敢,更直接,更愿意把没有完全想清楚的东西说出来。

2026年的写作,是一个开始知道自己可以被追问的人写的——所以他更谨慎,更有边界感,但有时候也更拘谨。

这不是退化,这是不同。

但J-023说的「退化是无声的」,是另一件事:

在2024年到2026年的某个时间段里,我的判断力曾经真实地退化过,而那段时间我完全没有意识到。

我是在比较两年前的文字和现在的文字时,才察觉到那段时期「某些东西变少了」。

不是因为AI,不完全是。

是因为我在那段时间非常高频地使用各种内容生产工具,非常高效地输出,非常流畅地「说话」——

但「说话」和「说清楚我相信什么」,是两件事。

那段时间,我做的是前者,以为是后者。

这就是为什么J-023的置信度是0.83,而不是更高——

因为我不确定我的观察是否真实,还是我在用一个「退化的叙事」解释一个「状态变化的事实」。

这个不确定,我决定保留,而不是用结晶的框架把它消除。


最后:那两个还没打开的文件

我在这篇文章里提过:有两个想法,在第一轮追问后我就退出了,原因写的是「没时间」,但真实原因是我不想面对追问的答案。

写完这篇文章,我打开了其中一个。

文件名是:2026-03-28-what-am-I-actually-building.md

原始捕获:

text


1
2


我在建什么?我真的相信自己在做的事吗,
还是我在相信「我应该相信它」?


这个想法在inbox里坐了58天,我一次都没打开过。

今天打开之后,我做了一次 /think 追问。

追问的过程很不舒服,我不打算在这里展示全部内容——因为那些回答是很私人的,而且还没完成。

但在第三轮追问里,Claude问了我一个问题:

「在你建的这个东西里,哪个部分是真正只有你能做的?」

我在文本框里坐了将近五分钟,什么都没有输入。

然后我输入了一个答案。

然后我把文件保存了,关掉了Claude。

这个想法现在是 status: 生长。

它可能会变成一个判断档案,也可能不会。

但它至少不再是一个我主动回避的文件了。


这是这篇文章最后想说的一件事:

使用一套迫使你追问的系统,最终的考验不是你追问了多少次,而是你愿不愿意打开那些你一直没有打开的文件。

那些文件才是你真正的知识边界所在。

追问已经打开的文件,是练习。

打开那些你一直在回避的文件,才是真正的事情。

我花了58天才打开那一个。

另一个还没有打开。

也许明天,也许下个月,也许等我想清楚了之后。

但它在那里。我知道它在那里。这和它不存在,是完全不同的两件事。

从一个问题开始:「让AI帮你思考更深,是否可能?」

90天后,我的答案是:可能。但AI帮的那部分比我想象的小。

真正做到深度思考的,是你自己。

AI能做的,是在你愿意深度思考的时候,让你无处可逃。

我是【一只阿木木】,AI 知识系统架构师,坐标杭州。
用 Obsidian + claude + skills + PARA + LLM Wiki 范式,帮普通人搭建由 AI 自动编译、自我进化的个人知识系统。
我相信:在 AI 时代,每个普通人都该拥有一个自动生长的知识系统

扫码加入行动营👇获取更多Obsidian + AI数字大脑实践

Image

关注【一只阿木木】。去做,才是真的学。🌊