一只阿木木

我把过去 3 年的 1287 篇微信收藏全部 ingest 了

——结果,出乎意料

作者:一只阿木木 我相信:在 AI 时代,每个普通人都该拥有一个自动生长的知识系统。


你的微信收藏里有什么

我猜你的微信收藏大概长这样:

最上面几条是最近收藏的,你还记得为什么存它们。

往下滚动 20 条,开始有点陌生了。

滚到 50 条,你开始遇到"这是什么?我为什么存这个?"

滚到 100 条,你基本上已经进入了一个你不太认识的人的精神世界——但那个人是三年前的你。

继续滚。

200 条。400 条。800 条。

1287 条。

这是我三年来的微信收藏总数。

这件事是怎么发生的

2023 年 3 月,我开始认真写公众号。

那时候我觉得,好的内容创作需要大量的素材积累。于是我开始疯狂收藏——每看到一篇觉得有用的文章,收藏。每看到一个让我觉得"哦这个以后能用上"的数据,截图存进去。每看到一个让我一瞬间有感触的句子,长按收藏。

然后呢?

然后就没有然后了。

收藏进去的东西,95% 都没有再被打开过。

我知道这是一个问题,但我一直用同一个借口安慰自己:"至少存着,总比没有强。"

直到两个月前,我用 claude-obsidian 做了一件在此之前我一直在拖延的事:把过去三年的 1287 篇微信收藏,全部处理一遍,ingest 进知识库。

这件事花了我 11 天。

结果,出乎我的意料。

第一个意外:我根本不知道自己在关心什么

在开始处理之前,我以为我非常清楚自己的关注方向:AI 工具、知识管理、内容创作。

这是我对自己的认知。

但当 1287 篇收藏全部进入知识图谱之后,系统给了我一个话题分布图。

排名前五的话题是:

text

1. 注意力与专注力(被引用 234 次)
2. 创作者的生存焦虑(被引用 189 次)
3. AI 工具与工作流(被引用 156 次)
4. 独立生活与自我认知(被引用 143 次)
5. 知识管理与学习方法(被引用 128 次)

我的第一反应是:不对吧?

我以为 AI 工具会排第一。结果它排第三。

比它高的,是"注意力与专注力"——我根本没意识到这是我最关注的话题——以及"创作者的生存焦虑"——这是我从来没有主动说过自己在关心的议题。

我盯着这张图看了很久。

然后我意识到:我收藏的东西,比我认识的自己,更诚实地记录了我真正在意什么。

收藏行为是没有经过"自我形象过滤"的。你点收藏的那一刻,是因为这个内容触动了你,而不是因为你觉得"我应该关注这个话题"。

所以,1287 篇收藏的话题分布,是我三年来真实关注方向的忠实记录。

而那个最真实的关注,和我自以为的关注之间,有明显的落差。

这是第一个意外。

第二个意外:我有 11 个"半生不熟"的话题

知识图谱生成之后,我执行了一次 lint:

text

lint the wiki

除了常规的孤儿页和断链,系统还给了我一份特殊的报告:

以下话题有 5 个以上相关页面,但没有任何综合分析页(synthesis page)。 这可能意味着你对这些话题有持续关注,但尚未形成系统性理解:

text

1. 播客行业的商业模式演化(8 个页面,跨越 2023-2026)
2. 创作者倦怠与可持续性(7 个页面)
3. 长视频 vs 短视频的注意力经济学(7 个页面)
4. 写作与思考的关系(6 个页面)
5. 个人品牌在 AI 时代的价值(6 个页面)
...(共 11 个)

这 11 个话题,每一个我都"知道",都读过相关文章,都觉得"有道理"。

但我从来没有认真想过:我对这些话题的真实立场是什么?

它们是"半生不熟"的知识——吃了一半但没消化完,进了收藏但没有进大脑。

系统把它们全部翻出来,摆在我面前,让我没有办法继续装作没看见。

这是第二个意外。

第三个意外:三年前的我,比现在的我更激进

我开始按时间顺序看这些收藏,从 2023 年最早的那批开始看。

2023 年的收藏,主题很集中:独立创作、打破体制、不被定义……那时候我刚辞职,满腔热情,对任何"叛逆"的声音都有强烈共鸣。

到了 2024 年,主题开始转变:系统、效率、可持续……开始关注怎么长期做,不只是怎么开始。

到了 2025 年,开始大量收藏关于 AI 工具的内容,以及越来越多关于"人在 AI 时代的价值"的思辨性文章。

系统在 wiki/synthesis/ 里自动生成了一篇综合分析:

text

wiki/synthesis/三年关注方向演化.md

里面有一段自动生成的摘要,读起来像是有人帮我写的自我传记:

2023 年:关注"如何出走" 2024 年:关注"如何持续" 2025 年:关注"如何在变化中找到立足点"

我看完之后沉默了很久。

不是因为它写错了,而是因为它写得太准确了。

这三年,我确实经历了这个轨迹,但我从来没有这么清晰地看到过它。

第四个意外:有 37 对"矛盾收藏"

在 wiki 生成的过程中,系统标注了矛盾:

text

发现 37 处 [!contradiction]

37 对矛盾收藏。

我点开看了几个:

矛盾 1:关于"写作应不应该有商业目的"

我在 2023 年 7 月收藏了一篇文章,核心观点是:好的创作必须超越商业逻辑,一旦考虑流量就会失去灵魂。

我在 2024 年 3 月收藏了另一篇文章,核心观点是:不能养活自己的创作是不可持续的,拒绝商业化是一种懒惰的浪漫主义。

两篇我都收藏了,两篇我当时都觉得"说得很好"。

但这两篇的观点,是直接矛盾的。

矛盾 2:关于"是否应该保持风格一致性"

一篇说:创作者必须有清晰的人设和风格,读者需要知道你是谁。

另一篇说:太在乎人设会让创作者变成自己的囚徒,好的创作者应该不断突破和变化。

两篇我都收藏,两篇我都认为有道理。

矛盾 3:关于"是否应该追热点"

你知道这个矛盾的答案——因为每个关于内容创作的账号都讲过这个问题,而且答案总是两种,总是都有道理。

这 37 对矛盾,让我直面了一件我一直知道但没有清晰承认过的事:

过去三年,我在知识层面一直是矛盾的。

我没有真正厘清自己对这些核心问题的立场,我只是持续地收藏各种观点,告诉自己"这些以后都有用"。

但"以后都有用"和"现在一点立场都没有",有时候是同一件事。

第五个意外:我有 3 个真正没有被写过的洞察

这是最出乎意料的发现。

在执行完所有 ingest 之后,我问了一个问题:

text

based on everything in the wiki, what patterns or insights exist
that I seem to find important but have never written about publicly?

系统的回答,引用了大量 wiki 页面,给了我三个它认为"被多次暗示但从未被正面表达"的洞察:

洞察 1:你对"努力的叙事"有系统性的不信任

在超过 40 篇收藏文章里,你有意无意地收藏了批评"努力就会成功"这个逻辑的内容。但你从来没有在公开写作里正面表达过你对这件事的立场。

洞察 2:你认为"真正的创作者社群"几乎不存在

在你关于"创作者社群"的收藏里,批评性的文章数量是正面文章的 3 倍。但你的公开写作从来没有提过这一点。

洞察 3:你对"AI 工具热"有保留意见

在你收藏的 AI 相关内容里,有相当数量是关于 AI 工具被过度神话、实际效果被夸大的文章。你一边在学习 AI 工具,一边在收藏对它的质疑。

读完这三个洞察,我坐在那里,半天没有动。

它读出了我三年来没有说出口的东西。

不是因为我不敢说,而是因为我自己都不知道我在想这些。

是 1287 篇收藏记录了它,是知识图谱把它浮现出来。

11 天的操作细节:我是怎么处理 1287 篇收藏的

说完了意外,来说说这件事怎么做的——因为很多人会好奇这个操作层面的问题。

Day 1:导出和分类(2 小时)

微信没有官方的批量导出功能,所以我用了一个曲折的方式:

步骤 1:在电脑版微信上逐篇复制

电脑版微信的收藏功能支持查看全文,我写了一个简单的规则给自己:

  • 文字内容(文章):复制全文,存成 .md 文件
  • 图片/截图:只保留我当时在图片上手写的备注(如果有的话),图片本身放进 .raw/assets/
  • 短视频:如果有文字稿就保留文字,如果没有就跳过

步骤 2:粗分类(不要细分,粗分就好)

我只分了四类:

text

.raw/articles/    文章类
.raw/ideas/       我自己的想法和感悟
.raw/data/        数据、案例、统计
.raw/misc/        实在不知道怎么分类的

花了多长时间?

大概 2 小时,处理了前 200 篇。然后我放弃了逐篇手动复制,改用了更快的方式。

Day 2:找到更快的方式(关键)

逐篇手动复制太慢了。我花了半天研究更快的方案:

方案 A:微信文章直接用 Web Clipper

如果收藏的是微信公众号文章(大多数都是),可以找到文章的原始链接,用 Obsidian Web Clipper 直接 Clip 成 Markdown。比手动复制快 5 倍。

方案 B:批量处理"只有截图"的收藏

对于截图类收藏,我用了一个简单的策略:不 ingest 图片,只 ingest 我当时为什么存这张图的理由。

我新建了一个文件 .raw/misc/screenshot-notes.md,把每张截图用一句话总结("2024-03-15:截了一张关于播客商业模式的数据图,核心数据是…"),然后一次性 ingest。

Day 3-8:分批 ingest,每天处理约 200 篇(核心阶段)

每天的流程:

text

上午:用 Web Clipper 把当天的 200 篇文章整理好,放进 .raw/
下午:
  batch ingest
  (等待,通常 30-60 分钟)
  打开 Obsidian 图谱视图看新增的节点
  做简单笔记:今天 ingest 的内容里有没有什么让我意外的?
晚上:休息,不要继续工作(避免认知过载)

Day 9:第一次 lint,大扫除(3 小时)

text

lint the wiki

结果:

  • 孤儿页:89 个
  • 断链:34 处
  • 过时内容:12 处

花了 3 小时处理这些问题。其中最有收获的部分:翻看孤儿页,发现很多是"只被提到过一次,但从来没有被任何其他知识连接"的内容——这些正是我收藏但从来没有真正消化的知识点。

我没有删掉它们,而是在每个孤儿页上加了一个标签:#needs-more-context,提醒自己这些是认知盲区,以后遇到相关内容要回来补充。

Day 10:生成综合分析(最有价值的一天)

text

synthesize everything we know about 注意力与专注力 into a new synthesis page

synthesize everything we know about 创作者的生存焦虑

based on everything in the wiki, what patterns or insights exist
that I seem to find important but have never written about publicly

这一天生成了 11 个 synthesis 页面,包括前面说的"三年关注方向演化",以及那三个"从来没有被写出来的洞察"。

这是整个 11 天里智识收获最密集的一天。

Day 11:建立选题清单(30 分钟)

text

what topics in our wiki have been mentioned in 5 or more sources
but have no corresponding published article?

系统给了我一个 23 条的清单。

我把这个清单存进了 wiki/projects/未来选题清单.md。

这 23 条选题,是三年的阅读积累自然涌现出来的——不是我硬想出来的,是 1287 篇收藏告诉我的。

真实数据:11 天之后知识库是什么状态

text

总 ingest 来源:1287 篇(文章 894 篇 + 想法 213 条 + 截图备注 180 条)
生成 wiki 页面总数:1,847 个
  - 实体页(人物、机构、产品):423 个
  - 概念页:612 个
  - 来源摘要页:1,287 个(每篇来源一页)
  - synthesis 综合页:23 个(最有价值)
  - 待填写的孤儿页:89 个(认知盲区)

自动检测的矛盾:37 处
从未被公开写过的洞察:3 个(系统识别)
潜在选题清单:23 条

处理前可检索:约 5%(记得的)
处理后可检索:100%(全部在 wiki 里)

我后悔做这件事吗?

不后悔。但我想诚实地告诉你,它有一个地方让我不舒服。

那 37 对矛盾,那些我三年来"两边都点收藏"的对立观点,被全部明明白白地摆在我面前。

那种感觉,不是"哦原来如此",而是"我一直在逃避自己的立场"。

收藏是没有成本的。它让你可以同时"认同"完全对立的两种观点,而不必做任何选择。

但当所有收藏被整合成一个知识图谱,矛盾被系统标注出来,这种"无成本的中立"就没有地方藏了。

你必须面对:在这 37 个问题上,我到底怎么想的?

这是这件事最不舒服、也最有价值的部分。

不是信息,是被迫做选择的压力。

给也有"收藏坟场"的人:你应该做这件事

如果你的微信收藏超过 200 条,我建议你做这件事。

不一定要做 11 天,先做一个星期,处理最近的 100 篇。

你会发现的可能不是和我一样的东西——因为 1287 篇收藏是 1287 篇,是你的经历,是你的关注,是你的认知轨迹。

但你一定会发现一些出乎你意料的东西。

也许是你不知道自己这么关心的话题。

也许是你从没意识到自己一直在回避的矛盾。

也许是三个从来没有说出口但一直在收藏行为里隐隐出现的洞察。

收藏不是终点,整理才是。整理不是目的,浮现才是。

操作清单:你现在就可以开始

第一步(今天):

text

打开微信收藏
把最近的 20 篇文章找到原始链接
用 Web Clipper 发送到 .raw/articles/

第二步(明天):

text

ingest 这 20 篇
打开 Obsidian 图谱视图
看看系统生成了什么

第三步(这周):

text

问:what topics appear most frequently in my wiki so far
看看你以为你在关心什么,和系统告诉你你在关心什么,有没有落差

那个落差,就是值得探索的地方。


最后说一句

1287 篇收藏,三年的积累,我以为我了解它们。

直到它们被整合成一个知识图谱,我才发现:我不了解我自己,但我的收藏行为了解我。

这件事最深的价值,不是那 1847 个 wiki 页面,不是 23 条选题清单,不是可以 query 的知识库。

是镜子。

是第一次这么清晰地看到:我这三年,到底在关心什么。

如果你也有一个"收藏坟场",我真的建议你去面对它。

不是为了整理,是为了和自己好好谈谈。


👇 如果你想继续跟着做:

关注「一只阿木木」,我们在 AI 时代一起构建自己的知识系统。

我是【一只阿木木】,AI 知识系统架构师,坐标杭州。

扫码加入行动营👇获取更多Obsidian + AI数字大脑实践

Image

关注【一只阿木木】。

我相信:在 AI 时代,每个普通人都该拥有一个自动生长的知识系统

去做,才是真的学。🌊