创作者要努力像个人
我有个朋友祁勋,是学计算机的,喜欢古诗词,搞了一个写格律诗的AI,用的大语言模型。他把民国年间首屈一指的大诗人——陈三立一首诗的头一句,“夜气冥冥白”,放进去,让AI生成底下的七句,AI一口气生出来五首。另一个朋友程羽黑看到了,晒到朋友圈,让大家猜猜哪一首是人写的。
很难猜。一方面因为,他放出来的五首,都是AI写的。另一方面是,人和人之间,写诗差别都非常大,张三李四写的诗,和李白杜甫写的诗,都是“人写的”。我们如果把“人写的诗”列成光谱,它是一个很广泛的区间。只要AI写的诗能落到这个区间,我们就很难区分出来它到底是人写的还是AI写的。
有人招摇撞骗,开诗词培训班,自己又不会写,拿AI写的诗贴出来,说是自己写的——反正也不能查重。还有人拿AI写的诗去参加比赛,甚至能拿奖。
所以我觉得,判断一首诗是人写的还是AI写的,已经意义不大了。因为AI能写的诗,和人能写的诗,在特点和形态上,已经有很大交集了。
那么,作为创作者,今天的目标是什么?很简单,让人觉得,你搞出来的东西,落在AI能搞出来的东西外面。在程羽黑的朋友圈底下,顾一心写了一首诗,我竖了个大拇指,说,“一下子和ai区别开了”。
AI虽然能写很多文章,但也有很多文章它不能写。——我巴不得AI能写我这样的文章,那样我就不用写了,每天让AI替我更新就得了。我在一个大语言模型群里,见很多人参加一个测试,有人出一套题目,让人类和AI同时做,看看到底是人类爱说胡话,还是AI爱说胡话。
AI在很多考试方面,已经超过大多数人类了。不过,也有很多AI做不出来的题目。比方说,我在这篇文章底下的原文链接里,就放了600来道题,我相信目前的AI连1%都做不出来。我也把答案放进去了,除非它直接搜到我的文档,抄答案,否则,它能做对的,我相信不会超过6道。我拿bing和GPT试过十来道,都不行,一道都没做对过。五年后的AI,应该很难做对5%,也就是30道。——这些题目并不是“张三屁股上有几颗痣”那种,而是完全可以根据公开的文献,经过理解推理得到答案的。
不过,这些题目AI很难做出来的最主要原因,是因为人类也很少有人能做出来。其实,AI现在能够做出来的题目,基本上都是至少有一部分人类能做出来的。而我期待看到的是,AI做出来人类做不出来的东西。
我能想到的一个更有意思的测试是这样。比方说,50个人,每个人独立出一套题,30道或者多少。每个人出的题,让其他49个人和人工智能去做,如果49个人里面有一大半能做对,而人工智能做不对,这道题目就是好题目。我们根据谁出的好题目多,来给这50个人排名。
当然,前提是出题的人彼此不商量,也不认识,或者干脆从人群里面随机抽49个没有相似背景的人来做也可以。我们把所有“好题目”汇集起来,就能更清楚地知道人工智能和人类的差别。谁出的“好题目”最多,就表示谁更理解人工智能,也更理解人类。
出人类和AI都会做的题目很简单,比如2+3等于几;出AI会做人类不会做的题目也很简单,比如问它《史记》里面共有多少个“王”字;出AI和人类都不会做的题目,也不难,只要你对一个领域特别懂,你专门往那个领域的细节上出就行;但是,能出大多数人会做,而AI不会做的题目,就挺难的。恰恰是这种题目,能辨识出来,未来的AI应该在哪些方面加强改进。
最后说一句,可能得罪诗词圈朋友的话,AI之所以在五言律诗上容易以假乱真,说到底,我个人觉得,是因为五言律诗的天花板没那么高。
很多事情说破了,就是这么回事。