一只阿木木

23个档案+41次实践,我的AI知识库里有什么

23个档案+41次实践,我的AI知识库里有什么

这篇我告诉你:真实发生了什么。

包括数据、包括失败、包括三个完整的判断档案全文公开。

也包括一个结论——我在写这篇文章之前,一直不愿意承认它。

先说数据:90天真实发生了什么

这是我的Vault在2026年2月25日到5月25日之间的真实统计。

不是我挑选的好看数据。是全部数据。

text


1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33


捕获层(/inbox/)
├── 新建文件:127个
├── 平均每天:1.4个
├── 最多的一天:9个(3月17日,一场让我连续想了4小时的对话)
└── 最少的一天:0个(一共有23天是0捕获)

处理层(/thoughts/)
├── 从inbox迁入:89个
├── 最终停留在萌芽期:48个(54%)
├── 进入生长期:41个(46%)
├── 进入成熟期:31个(35%)
└── 进入结晶期/被放弃:各有一些(下面详述)

结晶层(/judgments/)
├── 最终结晶:23个
├── 平均从萌芽到结晶:34天
├── 最快:7天(J-014)
├── 最慢:78天(J-003)
└── 曾经结晶后被撤回降级:3个

冲突检测(/clash/)
├── 触发次数:67次
├── 发现真实冲突:19次
├── 发现张力(非直接矛盾):23次
├── 未发现冲突:25次
└── 处理了冲突后判断升级:11次

追问记录(/think/)
├── 总会话数:84次
├── 平均追问轮数:3.2轮
├── 达到L3深化层:31次
├── 未超过L1就放弃的:17次
└── 用户主动说「够了」:53次


这是原始数据。

在我分析之前,我想让你先看一眼:这些数字意味着什么?

127个捕获,最终只有23个结晶——转化率18%。

82%的想法「死了」。

关于那82%:死亡不是失败

这是我花了很长时间才想清楚的一件事。

最开始,我把这个18%的转化率看成是系统的失败——127个想法进去,只有23个出来,是不是太少了?

然后我意识到这个逻辑是错的。

想法在追问中「死亡」,本身就是系统在正常工作。

让我用几个真实的案例来说明。

死亡案例①:一个听起来很深刻但经不起追问的想法

原始捕获(2026年3月4日):

text


1
2


AI时代最重要的能力是「提问能力」,
而不是「答题能力」


我当时觉得这个想法很好。听起来深刻,容易记忆,符合时代叙事。

然后我用 /think 追问了自己:

text


1
2
3
4
5
6
7
8
9
10
11
12
13
14


Claude:你说的「提问能力」——提什么样的问题?
       对谁提?在什么情境下?

我:就是向AI提好问题,prompt工程那种

Claude:所以你的意思是「prompt工程能力」
       比「答题能力」更重要?

我:不完全是,我说的范围更广

Claude:更广是指什么?你能举一个「提问能力」
       帮助你解决了问题的具体例子吗?

我:……想不出来


在第三轮追问时,我发现这个想法其实只是「prompt工程很重要」的一个修辞美化版本。

我没有真正相信它——我只是觉得它听起来像是我应该相信的东西。

这个想法在inbox里停了一个月,没有再被打开。

最终被我标记为:status: 放弃reason: 表达大于内容

这不是失败。这是过滤器在工作。


死亡案例②:一个真实但无法说清楚的感受

原始捕获(2026年4月11日):

text


1


我感觉用AI之后,我的独处能力变差了


这是一个真实的感受。不是修辞,不是我觉得我应该有的想法——是我真实感知到的变化。

但在 /think 追问中:

text


1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18


Claude:你说的「独处能力」是什么意思?

我:就是一个人安静想事情的能力

Claude:你「变差」了——变差的具体表现是什么?

我:就是会更想打开手机或者问AI,
   而不是自己静静想

Claude:这个变化是使用AI之后开始的,
       还是更早就存在?

我:……不确定,可能智能手机时代就开始了

Claude:所以这个变化可能和AI关系不大,
       而是信息密度增加的整体影响?

我:可能是


这个追问让我意识到:我把「智能手机带来的注意力碎片化」归因到了「AI使用」上。

这是一个归因错误。

这个想法变成了一个更具体的问题:「注意力碎片化和深度思考的关系」——但这个问题太大,我目前没有足够的材料去结晶它。

当前状态:status: 生长注:等待更多素材

这也不是失败。这是想法在等待正确的时机。


死亡案例③:一个正确但不属于我的想法

原始捕获(2026年3月22日):

text


1


复利思维是现代最被低估的认知框架


追问过程很顺利。我能说清楚它,能处理反驳,能说清楚边界条件。

但在 /crystallize 的「一句话测试」之前,我做了一件事:

我搜索了一下这个想法的来源。

然后我发现这个想法在生产力类书籍里已经被说了几千遍了。它不是我在思考中形成的判断——它是我在某个时间点摄入了一篇文章,然后存进了「感觉像是我的想法」的地方。

这个想法是正确的,但它不是我的。

我在文件里写了一行注释:来源:外部摄入,非原创判断,然后标记为放弃。


这三种「死亡」案例说明了一件事:

一个想法从捕获到结晶的过程,就是「清除噪音」的过程。

噪音有三种:

  1. 听起来对但实际上空洞(案例①)
  2. 真实但归因错误(案例②)
  3. 正确但不属于自己(案例③)

过滤掉这三种噪音之后,剩下的23个判断——才是真正有价值的认知资产。


三个完整判断档案:全文公开

我选择了三个最典型的判断档案公开。

选择标准:

  • J-007: 形成时间最长、最曲折的一个(78天)
  • J-014: 形成时间最短、最干净的一个(7天)
  • J-021: 曾经被撤回降级、又重新结晶的一个

J-007:「在AI时代,判断力的护城河不在于你知道多少,而在于你能说清楚你为什么这么判断」

Markdown


1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119


---
id: J-007
statement: "判断力的护城河不在于你知道多少,
           而在于你能说清楚你为什么这么判断"
confidence: 0.81
status: 成熟
created: 2026-02-28
crystallized: 2026-05-17
source_thought: [[thoughts/judgment-moat.md]]
tags: [判断力, AI时代, 认知]
---

## 核心论断

判断力的护城河不在于你知道多少,
而在于你能说清楚你为什么这么判断。

---

## 支撑证据

**证据1:BCG 2026年研究**
AI重度用户中14%出现认知疲劳,
营销行业高达26%。
核心发现:AI加速了产出,但同时模糊了
「这是我的判断」和「这是AI的判断」之间的边界。

**证据2:个人观察**
在过去90天里,我测试了一个问题:
当被问到「你怎么看X问题」时,
AI重度用户的第一反应有两种——

A类:「我认为……因为……」(有论据)
B类:「我觉得……」(说不清楚原因)

我自己在开始使用这套系统之前,70%的回答是B类。
90天后,B类比例下降到了约30%。

**证据3:知识工作者薪酬结构**
2026年,顾问行业最高收费的服务不是「提供信息」
(这个AI已经全面替代),而是「在模糊情境下做出
可辩护的判断」。「可辩护」的意思是:能说清楚为什么。

---

## 处理过的最强反驳

**反驳**:
「说清楚为什么」只是表达能力,和判断力本身无关。
一个判断力很强但不善表达的人,
他的判断力就不是护城河了吗?

**我的回应**:
这个反驳揭示了一个重要的边界条件。

我的判断指的是「可验证的、可交流的判断力」——
即能够在协作环境中被他人理解、挑战和改进的判断。

不能被表达的判断,无法被他人建立在其上,
也无法被自己在回顾时验证是否正确。

所以「说清楚为什么」不只是表达能力——
它是判断力和外部世界发生连接的接口。

没有这个接口,判断力只存在于你自己的脑子里,
它的价值是孤立的。

---

## 边界条件

**适用**:
- 需要和他人协作的判断(商业决策、顾问建议)
- 需要跨时间验证的判断(你三年后能看懂你现在为什么这么判断吗)
- 需要被挑战和完善的判断

**不适用**:
- 纯直觉性的快速决策(紧急情况下没有时间「说清楚为什么」)
- 高度个人化的价值判断(「我喜欢X」不需要可辩护性)
- 专业技术性判断(医生的诊断判断有其自己的验证体系)

---

## 关联判断

- [[judgments/J-003-thinking-vs-knowing.md]]
- [[judgments/J-019-articulation-as-thinking.md]]

---

## 进化记录

**2026-02-28**:萌芽
原始想法:「AI时代,会说话的人更值钱」
(这个表述太俗,我知道这不是我真正想说的)

**2026-03-14**:第一次追问(L1)
问题:「会说话」具体是什么能力?
我的回答:不是修辞,是论证——说清楚判断的依据

**2026-03-29**:发现冲突(/clash触发)
和[[thoughts/tacit-knowledge.md]]产生冲突:
「最有价值的知识是无法被言说的默会知识(tacit knowledge)」
处理方式:两者都对,但适用范围不同
→ 默会知识在个人执行层面有价值
→ 可言说的判断在协作和验证层面有价值

**2026-04-18**:第一次尝试结晶(失败)
一句话测试:说不清楚,用了60字
撤回,继续追问

**2026-04-30**:进入成熟期
处理了「表达能力vs判断力」的反驳
找到了「接口」这个核心隐喻

**2026-05-17**:结晶
最终的一句话:34字,用了6次修改

**总历时:78天**



J-014:「一个你说不清楚的想法,不是深刻,是未完成」

Markdown


1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124


---
id: J-014
statement: "一个你说不清楚的想法,不是深刻,是未完成"
confidence: 0.91
status: 成熟
created: 2026-04-03
crystallized: 2026-04-10
source_thought: [[thoughts/clarity-test.md]]
tags: [思维清晰度, 写作, 认知]
---

## 核心论断

一个你说不清楚的想法,不是深刻,是未完成。

---

## 支撑证据

**证据1:亲身经历**
在这90天里,我多次遇到一个模式:
某个想法让我感到「这很深刻,但我说不清楚」。

每次我选择继续追问而不是接受这种感觉,
最终要么——

A:说清楚了,发现其实不深刻(只是表述模糊制造了深刻感)
B:说清楚了,发现真的很深刻,而且更深刻了

从来没有出现过:
C:说不清楚,但它就是深刻的

**证据2:写作观察**
最好的非虚构写作者有一个共同点:
他们能把复杂的想法用简单的话说清楚。

不是简化,是清晰化。

这不是「简单就是好」的观点——
而是「清晰才能验证」:
说不清楚的想法,你无法知道它是不是真的对的。

**证据3:苏格拉底的工作方式**
苏格拉底最常做的事是:让对方把「感觉上很清楚」
的东西用语言说出来——然后这个东西就崩塌了。

这不是诡辩,这是澄清:
语言是思想的X光,照出来之后,你才知道里面有没有骨头。

---

## 处理过的最强反驳

**反驳**:
维特根斯坦说:「凡是可以说的,都可以说清楚;
凡是不可以说清楚的,就应该沉默。」
但这不意味着「说不清楚的就不深刻」,
而是意味着「有些深刻超越了语言的表达能力」。

**我的回应**:
这是一个有力的反驳,它让我修改了判断的边界。

「说不清楚」有两种:

第一种:想法本身就是模糊的,你以为是深刻,
其实是朦胧。这种说不清楚,不是深刻,是未完成。

第二种:想法本身超越了现有语言的表达能力。
这种说不清楚,可能确实是更深层的感知。

我的判断主要针对第一种——
这是日常思考中99%的「说不清楚」所属的类别。

第二种确实存在,但它极为罕见,
而且你通常能感知到两者的区别:
第一种的「说不清楚」让你有点不安;
第二种的「说不清楚」让你感到敬畏。

---

## 边界条件

**适用**:
- 日常的想法和判断(99%的情况)
- 你想要写下来或分享的内容
- 你想要基于它做决策的判断

**不适用**:
- 审美体验(一首诗的好,有时候真的说不清楚)
- 早期的直觉(刚产生的想法允许模糊,问题是你不能永远停在那里)

---

## 关联判断

- [[judgments/J-007-judgment-moat.md]]
- [[judgments/J-022-writing-is-thinking.md]]

---

## 进化记录

**2026-04-03**:萌芽
起因:一次 /think 追问中,我对某个想法说「这个我说不清楚,
但我觉得它很深刻」,Claude回了一句:
「那最接近这个想法的东西是什么?」

我尝试回答——结果发现那个想法其实没有我以为的那么深刻,
只是表述模糊制造了深刻感。

**2026-04-07**:生长期
连续三天回想这个模式,发现它在我过去的写作里反复出现。

**2026-04-09**:成熟期
处理了维特根斯坦的反驳,区分了两种「说不清楚」。

**2026-04-10**:结晶
从萌芽到结晶:7天

这是我90天里结晶最快的一个判断。
可能因为它本身就是对「清晰度」的判断,
而用来形成它的过程就是一次清晰化的过程。

**总历时:7天**



J-021:「工具的价值不在于它能做什么,而在于它迫使你做什么」

(这是那个曾经被撤回降级、又重新结晶的判断)

Markdown


1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124
125
126
127
128
129
130
131
132
133
134
135
136
137
138
139
140
141
142
143
144
145
146
147
148
149
150
151
152
153
154
155
156
157
158
159
160
161
162
163
164
165
166
167
168


---
id: J-021
statement: "工具的价值不在于它能做什么,
           而在于它迫使你做什么"
confidence: 0.76
status: 成熟
created: 2026-03-11
first_crystallized: 2026-04-02(被撤回)
re_crystallized: 2026-05-20
source_thought: [[thoughts/tool-value.md]]
tags: [工具哲学, 认知, 设计]
---

## 核心论断

工具的价值不在于它能做什么,
而在于它迫使你做什么。

---

## 关于这个判断被撤回的说明

**为什么第一次结晶(4月2日)后被撤回:**

第一次结晶时,我的原始论断是:
「好工具的本质是迫使你做有价值的事」

三周后,我在一次和朋友的对话中被挑战:
「一把好锤子迫使你做什么了?
它只是帮你更好地钉钉子。
你的判断只适用于认知工具,不适用于所有工具。」

这个反驳让我意识到:
我的判断有一个重要的限定条件我没有说清楚——
它只适用于「用于延伸认知能力的工具」,
不适用于「用于替代体力劳动的工具」。

而且更重要的是:
我原来的判断有一个更深层的核心没有被抓住——

不是「好工具迫使你做有价值的事」(这太宽泛)
而是「工具的真正价值在于它设置的约束」(这才是核心)

**撤回后做了什么:**
把 status 从「结晶」降级为「成熟」,
重新进行了三轮 /think 追问,
找到了「约束即价值」这个更精确的核心。

---

## 支撑证据

**证据1:本套系统本身**

深思引擎最有价值的部分不是「Claude能帮我想更多」,
而是它设置的约束:
- /capture 迫使我在捕获时就问自己「这让我想到什么」
- /think 迫使我在说出想法后必须回答追问
- /crystallize 迫使我在结晶时必须说清楚反驳

这三个约束比三个功能更重要。

**证据2:打字机 vs 文字处理器**

一个被反复引用的观点:
用打字机写作的作家通常在初稿阶段更「逼自己想清楚」,
因为打字机不允许随意删改——你必须想清楚才打下去。

文字处理器给了你随时修改的自由,
这个自由同时带走了「必须先想清楚」的约束。

(这不是说打字机更好,而是说约束有它的价值)

**证据3:Obsidian的设计哲学**

Steph Ango关于Obsidian的核心设计决策:
「我们选择在某些方面表现不佳,
换来的是允许人们大量自定义的自由。」

这个「表现不佳」本身就是约束。
用户在Obsidian里必须手动创建结构,
这个「必须手动」就是Obsidian迫使你做的事——
迫使你真正思考你的知识应该如何组织,
而不是接受软件给你的默认结构。

---

## 处理过的最强反驳

**反驳**(来自被撤回的经历):
这个判断只适用于认知工具,
不适用于所有工具。
而且「迫使」有强制的意味——
最好的工具应该是让人「自愿去做」,
而不是「被迫去做」。

**我的回应**:

第一个反驳我接受:我的判断确实只适用于认知工具,
这是边界条件,不是判断的缺陷。

第二个反驳更有意思。

「迫使」和「强制」是不同的:
强制是外力压迫,迫使是设计约束。

一本书的页码「迫使」你线性阅读(或者反抗这个约束选择跳读),
这个「迫使」不是强制,而是结构。

好的认知工具设置的约束,
是那种「你会在约束里发现自由」的约束——
就像十四行诗的格律,限制了字数,
但这个限制反而逼出了精确的表达。

---

## 边界条件

**适用**:
- 认知工具(笔记、写作、思考工具)
- 学习工具
- 创作工具

**不适用**:
- 体力劳动工具(锤子、电钻)
- 纯效率工具(计算器、电梯)

**特别说明**:
「约束的价值」和「约束的数量」不成正比。
过多的约束会压制而不是引导。
最好的约束是「少而精准」——
就像好的诗歌格律,不是越严格越好,
而是恰好在那个位置给了你最有价值的阻力。

---

## 关联判断

- [[judgments/J-007-judgment-moat.md]]
- [[judgments/J-017-friction-as-feature.md]]
- [[judgments/J-014-clarity-test.md]]

---

## 进化记录

**2026-03-11**:萌芽
起因:在设计 /think Skill 的第五个版本时,
意识到这个Skill真正的价值不是它能问什么问题,
而是它设置的规则「强迫」用户必须回答一个问题才能继续。

**2026-03-24**:生长期
第一轮 /think 追问,开始区分「功能价值」和「约束价值」

**2026-04-02**:第一次结晶(后被撤回)
论断:「好工具的本质是迫使你做有价值的事」

**2026-04-25**:被撤回,降级为成熟期
原因:朋友的反驳揭示了边界条件不清晰

**2026-05-12**:重新追问
三轮 /think,找到「约束即价值」的核心隐喻

**2026-05-20**:重新结晶
新论断比原版更精确:「工具的价值不在于它能做什么,
而在于它迫使你做什么」

**总历时:70天(含一次撤回)**



三个被「结晶后撤回」的判断:失败全记录

除了J-021,另外两个被撤回的判断也值得详细说明。

被撤回的判断①:「快速迭代是AI时代的核心竞争力」

撤回原因:

这个判断在4月结晶,5月我读到一篇关于「AI加速迭代悖论」的研究——当每个人都在快速迭代时,迭代速度不再是差异化优势,而是入场门槛。

真正的竞争力是「在正确的方向上迭代」,而「正确的方向」需要深度判断,不需要迭代速度。

我原来的判断把「手段」当成了「目标」。

处理方式:撤回,重新追问。尚未再次结晶。当前状态:成熟期,等待更清晰的核心论断。

被撤回的判断②:「个人品牌的本质是让陌生人提前信任你」

撤回原因:

这个判断是从一篇关于个人IP的文章里提炼的。

在 /clash 检测中,系统发现它和我的另一个捕获有冲突: 「信任不是被设计出来的,是被证明出来的」。

追问后我发现: 「让陌生人提前信任你」暗示信任是可以通过包装提前获得的—— 这和「信任必须被证明」产生了根本矛盾。

更准确的表述应该是: 「个人品牌是你的工作记录的压缩格式」

但这个新表述我还没有充分验证。

处理方式:撤回,拆解为两个更小的想法,分别在生长期。


这三个被撤回的案例说明了一件事:

判断档案不是「完成了就不用动」的东西。它是你认知状态的实时快照——如果你的认知进化了,档案应该跟着进化。

结晶不是终点,而是一个暂时的「当前最佳理解」。


四个关键数字背后的真相

在90天的数据里,有四个数字我反复思考。

数字①:23天里捕获为零

整整23天,我没有捕获任何新想法。

最初我把这看成是「系统使用不够主动」。

后来我意识到这23天里有一个共同特征:它们大多是高度执行性的工作日——开会、写材料、处理项目。

这不是系统的问题,这是我自己的问题:在高度执行模式下,我没有给自己留下任何思考时间。

这个数字变成了一个意外的监控指标——当连续3天捕获为零,说明我的工作状态出了问题,不是效率低,而是深度思考时间被挤占了。

数字②:17次「L1就放弃」的追问

84次追问会话里,有17次在第一层澄清追问时,我就回答了「我不知道」然后没有继续。

我分析了这17次——

10次是「想法其实不值得深入」(捕获时的冲动,追问一个问题就退潮了) 5次是「时机不对」(我当时没有认知带宽继续思考) 2次是「追问的方式让我感到不舒服」(不是因为难,而是因为触到了某个我不想面对的盲区)

最后那2次值得单独说。

有两个想法,我在第一层追问后就退出了,理由是「没时间」——但我知道真正的原因是我不想面对追问的答案。

我把这两个想法标记了:status: 主动回避待处理

它们至今还在 /thoughts/ 里,没有被打开过。

这是这套系统的一个盲区:它能迫使你追问想法,但它无法迫使你面对你不想面对的事情。

这个盲区不是系统的设计缺陷,而是人性的现实。

数字③:11次「冲突处理后判断升级」

67次 /clash 触发里,有11次导致了「想法从生长期升级到成熟期」。

这11次是整套系统里我觉得最有价值的时刻——不是追问让我想得更深,而是和自己历史观点的碰撞让我想得更深。

最典型的一次:

text


1
2
3
4
5
6
7


新想法(2026-04-28):「专注力比智力更稀缺」

/clash 检测到冲突:
你在2026-03-15说过:「智力的本质是注意力的分配能力」

张力:如果智力就是注意力的分配,那「专注力比智力稀缺」
是什么意思?专注力是智力的组成部分还是前提条件?


这个冲突让我追问了整整两个小时。

最终的判断:「专注力是智力的燃料,不是智力本身——在注意力碎片化的环境里,有燃料但没引擎,和有引擎但没燃料,都到不了目的地」。

这个判断是 J-019,也是我个人认为90天里质量最高的一个。

冲突是催化剂。没有 /clash 这个功能,这个判断可能永远只是一个没有深度的表面观察。

数字④:3.2轮追问的平均深度

84次追问,平均3.2轮。

这个数字让我困扰了很久:系统设计的上限是5轮,而平均只用了3.2轮,说明大部分追问没有到达L3深化层。

我问自己:是不是设计有问题?

然后我重新看了那31次达到L3的追问——它们几乎全部对应了我23个判断档案里质量最高的那批。

3.2不是失败,而是说明不是每个想法都需要5轮追问才能成熟。

有些想法在第2轮就已经说清楚了。继续追问不会让它变得更深,只会让它变得更繁复。

追问的深度应该由想法本身的密度决定,而不是由系统预设的轮数决定。

这是一个我会在下一个版本的 /think Skill里修改的细节:把「最多5轮」改成「足够深入为止,通常2-4轮」。


这套系统真正改变了什么

到了这里,我需要回答那个最重要的问题:

90天,这套系统真正改变了什么?

我会诚实地区分:没有改变的、以及真正改变了的。


没有改变的

① 我的输出速度没有变快

这套系统没有帮我写更多文章、发更多内容、产出更多东西。

如果你用「内容产量」来衡量这套系统的价值,它是失败的。

② 我使用AI的频率没有减少

我没有变成一个「不依赖AI的思考者」。

我还在每天用Claude、用ChatGPT、用各种AI工具。

这套系统不是「戒AI的方法」,而是「用AI方式的转变」。

③ 我依然有很多未完成的想法

/thoughts/ 里仍然有48个萌芽期的想法, 14个生长期的想法在等待继续追问。

积压没有消失,只是变得更有层次了。


真正改变了的

① 被追问时,我有话说了

这是最具体的、日常可感知的变化。

在开始使用这套系统之前,当有人问我「你怎么看XX问题」, 我的回答大多数是—— 「我觉得……嗯,这个问题很复杂……」 然后给一个模糊的、面面俱到的表述。

90天后,我开始有了一个新的习惯:

被问到某个问题的瞬间,我的第一反应是: 「我的判断档案里有没有和这个相关的东西?」

如果有——我能给出一个清晰的、有论据的、知道边界条件的答案。

如果没有——我知道我应该说「这个我还没想清楚, 但我的判断是这个方向,不确定是否正确」, 而不是给出一个听起来有把握但实际上只是聪明地组织了词语的回答。

② 我能区分「听起来对」和「我真正相信」了

这是最难量化、但对我来说最重要的变化。

在开始之前,我无法说清楚「我相信X」和「我觉得X应该是对的」之间的区别。

90天之后,这两者之间有了一条清晰的分界线:

「我相信X」= X在我的判断档案里,有证据,处理过反驳,知道边界条件 「我觉得X应该对」= X在inbox或thoughts里,可能是萌芽,也可能是外部摄入的观点

这不是认知上的完美——而是认知上的诚实。

我现在说「我不确定」的频率比以前高了一倍。 但我说「我相信」的时候,我真的相信。

③ 我的写作起点变了

这是最意外的变化,我在开始系统设计时完全没有预料到。

以前写文章,我从「要写什么话题」开始。

现在写文章,我从「我的哪个判断档案足够成熟,值得展开」开始。

文章不再是「我对某个话题的调研输出」,而是「我的某个判断的公开表达」。

这两种起点写出来的文章,质量和辨识度是不一样的。

区别不在于信息量,而在于「这篇文章里有没有一个作者真正负责的立场」。


我不想承认的最终结论

写到这里,我必须说那个我在整篇文章里一直在绕开的结论了。

90天里,让我进步最多的,不是Claude,不是Skills,不是任何技术设计。

是那23次「一句话测试」。

记得 /crystallize Skill里的前置检查吗——在任何判断结晶之前,必须通过的测试:

你能用一句话说出这个判断吗?不超过30字。

每一次我坐在那里,试图把一个在我脑子里「感觉很清楚」的判断压缩成一句话——

那30秒的挣扎,比任何追问会话都更逼迫我真正想清楚。

这个测试的设计意图是「过滤」——只让成熟的想法通过。

但它的真正效果是「结晶」——通过强迫压缩,把模糊变成清晰。

语言压缩,不是对思想的翻译,而是对思想的最后一次提炼。

这个洞察让我重新思考整套系统的设计:

真正让人变得更有判断力的,不是更多的追问,不是更智能的AI——

而是那个必须独自坐下来、用一句话、对自己的认知负责的时刻。

AI可以帮你创造到达那个时刻的路径,但那个时刻本身,必须是你自己的。

这就是这套系统存在的全部理由。


写给想要开始的人

如果你读完了这篇文章,我想对你说的最后一件事不是「你应该用这套系统」。

而是这个:

你已经有判断了。

只是它们散落在对话记录里、在你说过但没有认真对待的话里、在你觉得「这话说了也没人懂」的念头里。

这套系统做的事,不是帮你生成判断,而是帮你找回那些你已经有、但还没有负责的判断。

找回一个,压缩成一句话,弄清楚你为什么这么想,处理一个反驳,说清楚边界条件。

然后再找下一个。

六个月后,你不会变成另一个人。

但你会认识那个「真正的你相信什么」的自己。

这比成为另一个人更难,也更值得。


结语

这六篇文章是我在2026年上半年做的一件事:

把一个思维实验,变成一套真实可用的系统,然后用90天的时间验证它。

我不知道这套系统是不是最好的答案。

我知道它是我目前找到的、对「让AI帮你思考更深」这个问题最诚实的回答。

如果你读完了这个系列,有任何想法——无论是认同、反驳、还是「你漏掉了一个重要的东西」——

我希望你不只是想想,而是把它捕获下来,追问它,然后告诉我。

这是这个系列最后能做的事:

不是给你答案,而是给你一个追问的起点。


附录:23个判断档案的完整目录

(按结晶日期排序)

ID
核心论断(压缩版)
历时
置信度
J-001
速度是执行的价值,判断是思考的价值
42天
0.85
J-002
摩擦不是设计失误,是设计意图
28天
0.79
J-003
知道很多 ≠ 理解任何事
61天
0.88
J-004
第二大脑的敌人是第一大脑的懒惰
19天
0.77
J-005
系统的可靠性取决于最弱的环节
33天
0.82
J-006
问题比答案更持久
47天
0.84
J-007判断力护城河在于说清楚为什么78天0.81
J-008
注意力是认知资源,不是意志力问题
25天
0.80
J-009
工作流是固化判断的装置
31天
0.75
J-010
复杂性是不成熟的标志
14天
0.86
J-011
写作是思考的外部存储器
22天
0.91
J-012
边界条件是判断质量的真正指标
39天
0.83
J-013
过滤比收集更重要
18天
0.87
J-014说不清楚的想法不是深刻,是未完成7天0.91
J-015
AI改变的是认知分工,不是认知总量
55天
0.78
J-016
自动化不能替代你决定什么值得自动化
29天
0.84
J-017
摩擦是思考的介质
36天
0.82
J-018
个人知识的价值在于关联密度,不在于数量
43天
0.79
J-019
专注力是智力的燃料,不是智力本身
11天
0.88
J-020
被追问的想法才是你真正拥有的想法
20天
0.90
J-021工具的价值在于它迫使你做什么70天0.76
J-022
写作是把想法从脑子里请出来的仪式
16天
0.85
J-023
判断力的退化是无声的——你感觉正常,但已经不同了
48天
0.83
我是【一只阿木木】,AI 知识系统架构师,坐标杭州。
用 Obsidian + claude + skills + PARA + LLM Wiki 范式,帮普通人搭建由 AI 自动编译、自我进化的个人知识系统。
我相信:在 AI 时代,每个普通人都该拥有一个自动生长的知识系统

扫码加入行动营👇获取更多Obsidian + AI数字大脑实践

Image

关注【一只阿木木】。去做,才是真的学。🌊