王路在隐身

该给chatGPT分专业了


ChatGPT传得很神,前一阵我看朋友圈好些人都在转一个段子,说美国哪个学校的教授出了一篇论文,结果得A+的,写的最好的,是AI写的。转这篇文章的有些还是大学老师。因为我自己干过几年媒体,有个职业习惯,就是你会去查一下出处,看看它这个说法到底是真的是假的,那个说法没有任何出处,图片是乱配的,提到的教授名字也不知道是真的还是编的。我觉得这事儿不大可信。


过了几天,有朋友发给我一个链接,在国内可以用。我就问了它一道比较难的毗昙题目,它根本不知道题目是什么意思。我又问简单一点的,它还是不知道。最后我就问它一个翻书能够翻到答案的问题,我问:什么是无表色?它告诉我:无表色是一种特殊的颜色。我又问:根据《俱舍论》,律仪有哪些?它也答得完全不对。我就清楚了。现在它这个水平,肯定是写不了课程论文的。也就是说,如果AI写的课程作业能拿到A+,只能说明两点:要么,这个老师出的题目太水了,是那种完全不需要任何专业知识就可以写的。要么,这个学科它是一个假学科,没有任何真东西,没有任何专业的东西。


ChatGPT它的回答呢,能给你感觉它好像在对话。但是它不具备专业知识,也就是说,它数据库里会有一些专业术语,但是专业术语之间的联系,它是没有建立起来的。当然,我相信,如果进行有针对性的学科训练的话,应该是不太难的事情。但目前,它只能讲一些口水话。


我问它:中国最近放开的原因是什么?它给了一个表面上像样的答案,但内容特别不靠谱。它说,是疫情已经得到了有效的控制。我跟朋友说这事儿,朋友用英文问了同样的问题,发现它答得很不一样。这很好理解。我猜逻辑可能是这样:你用中文问的时候,它会搜集中文互联网上相关的话题,组合出来一个答案给你。你如果用英文问,也许它优先搜索的就是英文互联网上类似问题的讨论。如果一个问题确实是被广泛讨论的,那么,谁的声音高,它的声音就像谁的声音。而一个问题如果网上没有明确答案,它可能就很难回答。后来我又问了一个问题:陶渊明、孟郊、龚自珍,谁的诗好?谁脾气大?


一直没出来答案。我不知道是不是国内这个链接的问题。你可以在网上搜到很多关于陶渊明、孟郊、龚自珍每一个人单独的讨论,但是,让AI去比较他们的诗,比较他们的脾气,恐怕对AI有很大的考验。所以,我觉得下一步AI大概会和具体的学科内容相结合,有针对性地去训练,就像高中生考完大学会分专业一样,我们可以给AI分专业,比方说,学汉语言文学的AI,里面再分出专门学中国古代文学的AI,那它应该比较容易回答这个问题。


当它容易回答这种问题的时候,我们就可以让AI承担一部分论文审稿的工作了,比如让它判定哪些投稿的论文是垃圾,以后这些垃圾就不要再制造了。乃至让它来评判哪些论文是抄袭、造假、学术不端、图片误用什么的。


但这些有个前提,就是得给AI分专业,在具体的专业领域去训练它。如果不分专业的话,它可能永远也搞不清三个诗人哪个脾气大,哪个好相处,因为你去随机问一千个人,综合他们的声音,是肯定不行的,不如去问一个真正懂行的人。