王路在隐身

写小说,AI远远不行

1、调教GPT写小说失败 ‍

小说家可以骂人不带脏字,AI不带脏字就不会骂人。 ‍ ‍ ‍ ‍ ‍
GPT可以模仿鲁迅的口气,但模仿不了鲁迅的脾气。

2、写小说,AI远远不行


我昨天,调教GPT写了一段小说。它写的看起来像小说,外行会觉得那个就是小说,但内行知道,那个不是小说。不是说有人物、有对话,放在一起就叫小说。也不是说有事件就叫小说。小说里面的事件叫情节。不是所有的事件都能称之为情节。我们日常生活中发生的100件事里面,可能只有1件是情节。我中午吃了一顿西红柿鸡蛋面,这个不叫情节。因为你从这件事里看不出来我的性格。《狂飙》里面,张颂文吃猪脚面,这是个事件,他一辈子吃过很多次,但只有在和安欣一起吃猪脚面的那一顿,才是情节。因为那一顿饭能看出来他的性格,看出来他和安欣的价值观的不同,以及基于这种冲突所产生的有戏剧性的细节。


有戏剧性的细节,是包含作伪的。一个人不饿的时候,说我不饿,这不是情节,也没有戏剧性。一个人饿得不得了,还是说我不饿,这里面就有故事。一定有一个更重要的原因,让他说我不饿。而这一点,AI是不知道的。我昨天反复测试ChatGPT,它不懂这一点。它写的小说,里面的人物基本上是有什么说什么。饿了就说我饿,破坏了人家的什么东西,就说对不起。但故事不是这样的。小说不是这样的。一个人物如果特别通情达理,在他身上就很难产生故事,除非撞上特别蛮不讲理的人。一个女人想和她不认识的富豪发生点什么关系,她走到富豪身边的时候,可能会故意把红酒杯弄翻,把富豪的衣服给弄脏。她不是不小心弄翻的,而是有预谋的。这里面就有撒谎和欺骗。而AI写小说,它会写这个女人是不小心弄翻的。不小心弄翻,这个故事就撑不起来,就不能成立。


情节的成立有两种原因,比较低级的原因,是制造误会,误会可能源于信息不对称,一句话老早讲出来就没事了,但就是不讲。这是比较低级的写法。高级的原因,是人物的价值观不一样,认识不一样,对事物的理解不一样。得了新冠了,到底是该吃连花清瘟还是布洛芬,还是两个放一块吃,一家两口子,认识不一样。那就肯定要产生冲突。这个冲突是你避免不了的。


而目前的AI,GPT写小说,它还不懂去这样设计人物,它设计的每一个人物,基本上都是跟它分享共同的价值观和认知的。这样一来,不可能有真正的冲突。我为了让它把故事写起来,设定了一个场景,老舍的茶馆,让林黛玉、关羽、潘金莲、孙悟空四个人物在茶馆里相遇,但AI不能真正地理解这四个人物。它不知道潘金莲和林黛玉的根本差别在哪儿。虽然它能介绍出来潘金莲和林黛玉的背景。


所以说,我们想让AI写小说,必须对它进行特殊的、专门化的训练。只有训练它的人是一个真正懂小说的人,才有可能产生真正的能写小说的AI。有人让GPT模仿仁波切,告诉它仁波切的一些特征,然后觉得模仿得太像了。朋友告诉我的时候,我心想,估计是仁波切模仿起来比较容易吧。结果打开聊天内容一看,压根儿就不是仁波切。因为你想让它模仿仁波切,首先你自己得知道仁波切的特点是什么。同样的道理,想让AI写小说,设计它训练它的人,首先自己得知道小说是什么。想让AI写出某种类型的人物,比如说贾宝玉,首先训练它的人内心里面得有贾宝玉这种人,要明白产生贾宝玉这种人的环境。小说家非常多,马尔克斯,也是伟大的小说家,他能不能写出来贾宝玉?他写不了。莫言,能不能写出来安娜卡列尼娜?他也写不了。小说家内心里面如果没有一种人物,不熟悉人物和情节产生的特定环境,这种人物、情节就出现不到你的笔下。


目前的AI,它被设定成一个特别彬彬有礼、特别友好的一种形象。那么这种设定,有可能是它写小说的一个非常大的障碍。因为它恐怕没有办法去真正地理解一些事情。没有办法理解在某种的环境下,普通人身上的恶是怎样被激发的。它恐怕很难理解一个人在自己家门口被人拦住不让进,而拦人的人还可以特别理直气壮。——这个逻辑它基于什么懂呢?基于公开的信息它是不能懂的。它难以理解有人可以毫无顾忌地闯进别人家里,把别人家的狗打死,还可以逍遥法外。它难以理解一个人信誓旦旦强调的东西可能压根儿连自己都不相信。那么,它就无法写出来真正有价值的文学作品。


鲁迅《野草》里面讲过一句话:当我沉默的时候,我觉得充实;我将开口,同时感到空虚。鲁迅还写过一首诗:心事浩茫连广宇,于无声处听惊雷。前两句叫:万家墨面没蒿莱,敢有歌吟动地哀。鲁迅是从沉默中汲取养分来创作,AI则是从网上铺垫盖地的信息流中抓取材料来制作;鲁迅听到的惊雷在无声处,AI听到的惊雷在天打五雷轰处。AI能模仿鲁迅的口气,但模仿不了鲁迅的脾气。指望AI写出来好的文学作品,首先要让它的血从冰冷变得滚烫。