王路在隐身

考虑建个手搓阿毗达磨AI群

目的是搞出来个懂点阿毗达磨的AI。

2023年4月,我尝试过用阿毗达磨文本微调GPT2等开源模型。最近(2025年2月),我又开始尝试微调DeepSeek-R1-Distill-Llama-8B等。因为通用模型在阿毗达磨上的表现并不好。不好的原因不是因为智能达不到——不可能说数学奥赛能得高分的模型搞不定阿毗达磨,而是因为那些模型根本就不搞阿毗达磨。就好比一个再聪明的数学家,也不一定掌握很简单的化学知识,因为他根本没有花精力去学过化学。

从技术上看,大语言模型早就具备精通阿毗达磨的能力了,而之所以还没有让技术变成现实,是因为没有需求,也就没人去把它做出来。说白了,一个精通阿毗达磨的AI并不能解决社会的需要、人类的困扰,不能提升工作效率,不能帮你省钱或赚钱。懂机器学习的人不少,但其中99%的可能根本不知道阿毗达磨是什么。而搞阿毗达磨的,也基本不懂机器学习。

我想建这个群,就是想找到对阿毗达磨和机器学习都有兴趣的人,来尝试解决这个可能不算难的问题。很多时候,一个问题放在那儿几十年甚至上百年没解决,不是因为难,而是因为没人关注,没人有兴趣,导致很多有能力解决的人根本不知道那些问题的存在。

进群资格,要求同时满足以下两点:

1、对阿毗达磨有最基本的了解。(表现为手里有完整而干净的《俱舍》《正理》《婆沙》的TXT。)

2、对机器学习有最基本的了解。(表现为微调过大语言模型。)

目的:

1、手搓出来在阿毗达磨上效果比通用模型好的AI。(拿今天来说,就是比o3、grok3、r1好。)

2、给一段阿毗达磨文本,能识别其正误。

不了解阿毗达磨的人,可能觉得目标不现实。他们很容易去用数学、编程乃至语言能力类比——怎么可能参数量巨大的通用模型搞不定,参数量小的模型反而能精通?

我举点例子吧。

你问deepseek:根据《俱舍论》,见道有多少刹那心?

deepseek大概率会告诉你:16心。

deepseek的能力要比Claude 3.5 sonnet强,比Grok3弱(大体上讲)。但如果你问Claude或者Grok3,它们都会告诉你正确答案:15心。

现在我告诉你,15心是正确答案。你一秒钟就记住了。——没有任何难的地方。那为什么deepseek还搞错呢?因为如果你去翻学者论文,你会发现论文里把《俱舍论》的见道介绍为16心的比例远远超过15心。

《俱舍论》本身主张多少心呢?15心。既然如此,为什么很多论文说成16心呢?

这是个“阈值”和“阀值”的问题,也是个“差强人意”的问题。

你在网上会看到很多人用“阀值”,用得怎么样?差强人意吗?可以说“差强人意”,但毕竟不差强人意。

学者写《俱舍论》的论文,解释《俱舍论》,很多时候主要不是参考《俱舍论》,而是参考别人对《俱舍论》的讲解和注释(因为自己读不懂《俱舍论》)。就好比聊康德的那么多,有几个是直接啃康德的?大部分是通过研究康德的学者去了解康德的。

再换一个问题:根据《俱舍论》:贪瞋痴是意业吗?

Deepseek,Claude,Grok3,都可以回答对:不是。

但如果你去看阿毗达磨学者的论文,不知道多少学者分不清“业”和“业道”,把“贪瞋痴”说成“意业”。日本有个阿毗达磨学会,七八个学者研究《业品》,合写论文,每篇都大几十页,对比梵藏文本各种注疏,但是,分不清“业”和“业道”,把贪瞋痴说成“意业”,也搞不懂“无痴”和“正见”有什么区别。——目前通用的AI,起码已经知道“业”和“业道”的不同。不过,想让AI搞清楚“无痴”和“正见”的区别,恐怕得通过专门训练。

目前通用的大模型在阿毗达磨上表现欠佳,主要是因为缺少高质量数据的针对性训练。而高质量数据是现成的。——就是前面说过的“完整而干净的《俱舍》《正理》《婆沙》文本”。任何一个对阿毗达磨略有了解的人,手里都有这些。当然,如果要做强化学习,还得想办法去处理加工这些原始数据。如何设计奖励函数?集思广益会更好一些。

刚才我们说,第一个目标是“手搓出来在阿毗达磨上效果比通用模型好的AI”;第二个目标其实一样,只是说得更具体:“给一段阿毗达磨文本,能识别其正误”。

举个例子:

【解释一下这句话,并说说其中有没有错误:《經論講要》:「五法為法智所知(即欲界相應不相應、無漏有為相應不相應,及無為善)、七法(三界相應不相應、與無為善)為類智所知」(CBETA 2024.R3, LC07, no. 7, pp. 175a13-176a1)】

这是吕澂讲阿毗达磨的一段。我拿去问deepseek,Claude和Grok3。deepseek和Claude都指出了吕澂的错误(DS:“三界相應不相應”包含欲界,与类智仅缘上二界矛盾;Claude:这种表述不够准确,因为类智实际上缘的是上二界(色界、无色界)的法和无为善法)。但问题在于,它们同时把吕澂不错的地方也批评为错的。而Grok3没有发现吕澂的错误。都不够理想。

理想的情况是,吕澂对的我们能明确他对,错的能精准指出哪里错了,正确的是什么,即回答:【“七法”应该解释为:色无色界无漏有为相应不相应,与无为善。】最好能甩出《俱舍》的【类七苦集六】或【類智緣七,謂色無色無漏道六及善無為】。

如果手搓出来的模型,能达到这个标准,就可以了。这个标准对AI来说不高,只要大模型能读懂不到40万字的《俱舍》,就可以了(但对阿毗达磨学者来说很高,因为绝大多数阿毗达磨学者只能读懂《俱舍》很少的一部分)。——如果这个思路可行,那么让大模型读懂康德,读懂《十三经注疏》,读懂六朝骈文中那些典故,都是不成问题的。那么,很多学者也就不必去吭哧吭哧皓首穷经地搞出一堆雷人注释了。

说到这儿,我觉得如果你不是对阿毗达磨感兴趣,但对如如何搞定古典文献中的注释感兴趣,比如让AI去检查白居易诗集笺注中哪些注释错了,或者让AI给一部古典文献正确的注释,我觉得也可以加到群里来。问题在本质上异曲同工。只不过,后者要比阿毗达磨更难。

阿毗达磨的数据非常小,如果群能建起来,就是大家各自尝试各自的想法,分享经验和技巧。毕竟一个人闭门造车,很容易掉坑里。满足如上两个条件又感兴趣的朋友,请通过邮箱联系我:

[email protected]。

如果已经有我微信,也可以直接微信。

单枪匹马手搓一个擅长阿毗达磨的AI?