王路在隐身

蒙克论文中的AI使用不是太多了,而是太不够

最近,蒙克老师关于春秋战国分期的论文(公元前546年:春秋战国历史分期的机器学习新证)引发了不少讨论。很多声音集中在一个看起来很热闹、其实根本不重要的问题上:这篇论文到底有多少文字是 AI 写的。

这是一次明显的误焦。

真正遗憾的,并不是蒙克用了 AI,而是他把 AI 留在了润色文字、优化表达的层面,却没有让 AI 进入到最关键的地方——逻辑结构和概念设定本身。恰恰是在那里,这篇论文暴露出了问题。

一、把 AI 当“高级文秘”,是对它价值的最大浪费

我们现在对 AI 的很多焦虑,都集中在“它会不会替人写文章”。但在学术研究里,如果只是用 AI 来修饰语句、调整节奏、让文章读起来更顺,这反而是最安全、也最廉价的用法。

这就像买了一辆性能极强的车,却只用它来听广播。不是不能听,而是太可惜了。

蒙克在回应中坦率说明了自己如何使用 AI 进行文字润色,这种坦诚本身值得尊重。但问题在于:如果一篇论文的逻辑内核足够坚硬,文字是否优美并不会改变它的说服力;反过来,如果逻辑内核存在结构性问题,那么再流畅的文笔,也只是在问题外面刷了一层漆。

二、“规范性权威”里的陷阱:当权重本身就携带权力

这篇论文的中心结论很清楚:在公元前 546 年之前,“道义”(规范性权威)比“拳头”(强制性权力)更能解释国家行为;此后则相反。为了支撑这一判断,蒙克构建了一个看似精巧的指标体系,其中最关键的一步,是在判断战争“义 / 不义”的基础上,引入“距离”作为权重。

用蒙克的话说:“一场付出巨大代价而主动进行的正义战争,将比另一场代价微小的以武装干涉做出的顺水人情所体现的正义性更高。”

也就是说,蒙克定义的“正义”是拿史书上的“正义”乘以“拳头究竟有多硬”“胳膊到底能伸多长”。

假设有两个国家,A 国和 B 国。它们发动的“义战”数量相同、性质相同。区别只在于,A 国弱小,只能在周边活动;B 国强大,是霸主,能够把军队投送到很远的地方。按照蒙克的算法,B 国的“规范性权威”得分会显著高于 A 国。

这个差距,真的说明 B 国更讲道义吗?它至少同样可以解释为:B 国更有后勤能力,更有组织能力,更能承受长距离动员的成本。

问题就在这里。那个被用来给“道义”加权的距离,本身携带了大量“权力”的信息。能够频繁进行远距离战争的,无论义与不义,几乎必然是强国。当距离被加权进“规范性权威”的公式时,强制性能力就被悄无声息地注入了道义指标之中。结果是,“权威”和“权力”这两个本应区分开的概念,在测量层面发生了混杂。

这不是一个表述问题,而是一个结构性问题。就像你比较跑步成绩,却把选手的臂展长度乘进了分数里——哪怕你并没有说“臂展等于跑得快”,比较本身也已经失去了意义。

三、AI 本可以是最好的“反对派”

这种问题,恰恰不是人类最容易第一时间意识到的,但又是 AI 非常擅长指出的。

如果在论文定型之前,蒙克没有把 AI 当成润色工具,而是把变量定义、计算逻辑和核心结论一并交给 AI,然后问它一句:“我想比较道义与实力的作用,用战争距离给道义加权,这里有没有内生性或概念混杂的问题?”

AI会直接指出:战争距离本身是国家投送能力和组织能力的体现,把它作为道义的权重,会导致道义指标被实力指标污染,从而使两者的比较失去解释意义。

这才是 AI 在学术研究中真正不可替代的价值。不是告诉你应该怎么写,而是提醒你不该怎么写。它可以充当一个冷酷、没有人情的审阅者,专门盯着你最自信的地方挑毛病。

蒙克在这篇论文中,用 AI 把文本写得更漂亮,却错过了用 AI 给逻辑“排雷”的机会。他把一把很锋利的工具,用在了最不锋利的地方。

四、“不明觉厉”的时代,正在走向终点

这场争论,其实还揭示了一个更大的变化。

在过去很长一段时间里,学术写作中确实存在一种隐形的安全区:只要方法足够复杂、术语足够新、跨学科色彩足够强,很多读者和审稿人就会因为看不懂,而默认作者高级。这在客观上形成了一种跨学科的套利空间。

AI 的出现,正在迅速压缩这种空间。现在,一个普通本科生,也可以把论文中最复杂的部分交给 AI,让它拆解逻辑、解释变量、指出可能的漏洞。“不明觉厉”正在变得越来越难。

这不意味着学术会走向浅薄,恰恰相反。它意味着,真正能站住脚的,只能是逻辑本身。再先进的模型、再华丽的叙述、再复杂的公式,都无法替代概念的清晰和推理的自洽。