[杉井光][短篇]无数猴子黯然神伤 敲打无数打字机咔哒作响 此声若能响彻云霄 AI变革必将一日千丈
坑光短篇一则
原文:https://kakuyomu.jp/works/16817139558351523055/episodes/16817139558362972862
标题是改编自蓝心乐队的Train-Train中的歌词
====================================
「要想AI能写出真正有意思的小说,还要再花50年吧。」
泷泽教授如此断言。
他是我们K大学文学部最年轻的教授,同时还是一位文学奖得奖经历极为耀眼的作家,他的这句话分量可不轻。
然而,我当了教授的助手很长时间十分清楚,这时最好是用轻率的态度提出疑问,这样教授才会心情好。
「是这样吗。生成图像的AI最近可是完成了指数级的进化,和人的画比起来也毫不逊色——不止如此,有的领域已经可以创作出彻底超越人类的作品了。」
「画和小说可是完全不同哦,相川君。」
「这我当然知道。不对,对AI来说,小说不应该反而更有利吗。语言信息占用的空间明显比画像要少,还是彻底的数码数据,没有任何偏差或是模糊之处。」
「没想到你会给出这么愚蠢的意见,真令人伤心。看来我教育得还是不够啊。」
教授嘴上这么说,可语气中根本感受不到遗憾,反而有些开心。
「AI要自动生成某些《产物》,有两种方法。一种是自上而下(Top-Down)。将《产物》的制作意图和构造,以及创造价值的机制完美地数值化,然后组建起算法。第二种是自下而上(Bottom-Up)。只要是人们评价有价值的既有产物全都拿来,将这些产物大量输入后,通过学习令算法越来越精简。那么,你觉得自上而下的方式适用于小说吗?」
我思考了一下,然后回答道:
「没办法。」
「原因呢?」
「现如今,还没有任何人能够严格定义小说的有趣程度。」
教授满足地点了点头。虽然他已经四十多了,但这种时候,他的表情却像极了小孩子,这点某种意义上还挺招人喜欢的。
「回答得很好,相川君。那么就只剩下自下而上的方式了。和自动生成画像的AI做的一样。读取大量的照片与绘画将其分解,提取出特征,拼接出一张图片后再调整透视和色彩等来保证整体的统一,最后输出结果。也有人在研究用同样的手法来自动生成音乐。乍一看小说也可以用同样的方法生成。但是啊,相川君。绘画与音乐,和小说之间有着致命的差别。你知道是什么吗。」
「……不知道。」
「差别就是,小说这种艺术形态中,有价值的作品与纯粹的垃圾之间的差距极为微小。」
泷泽教授得意地将声调提高了一个等级。
「图像的话,哪怕画面中一个物体的宽度产生几像素的增减,也基本不会影响整个作品《很像绘画》的感觉。但只改变小说中的一个字,价值就不如从前的例子并不少见。哪怕文章表面上看似没有变化,也是如此。举个例子,『络新妇之理』的第一句如果是『你——就是蜘蛛吗?』,那一定十分扫兴吧。」
【译注:『络新妇之理』的原文中是肯定语气。】
原来如此。确实,要是看到了我一定会说’再自信点啊京极堂‘。
「哪怕只改了一处就已经这样了。那要是许多地方都产生了变动,名作瞬间就会变成垃圾。文章包含的意义连在一起才创造出小说的价值,仅仅一个字就能连接起话语,同时也能将话语切断。正因如此,通过大量的学习去构筑《相似感》是没有用的。当然这可以自动生成乍一看像是小说的文章堆叠,但只要一读,就会发现只是没有价值的垃圾罢了。」
「可自动生成图像的AI不也只是输出了乍一看《像是画》的产物吗?」
「一点没错。然而,这乍一看《像是画》本身就是绘画的价值。小说却不同。基于同样的原因,持续吸收人类的判断,不停地重塑算法——这一形式也是如此,对图像来说实现很简单,小说却很困难。图像的价值瞬间便可以判断,相对地小说却一定要读到最后才会知道是否有趣,而且说到能不能理解其有趣之处,人与人之间的差距也很大。」
也多亏了如此,我现在还不至于失业啊,留下这句话后,教授离开了研究室。和以前一样,他依然开着所有电脑的电源,因此我才能继续思考与做事。
※ ※ ※
泷泽教授留下了几个重要的启发点。
问题已经全部弄清,之后只需要一个一个解决。
首先,自上而下的方式很明显走不通。定义小说的有趣程度就相当于彻底分析出人类的意识与思考。到能够实现那种事情的时候,早就不是自动生成AI这种维度了。
自下而上方式的问题中,首先是《一字之差就会令名作变垃圾》问题,确实很难解决,但说到底也只是程度的问题。
图像AI要是生成了一半是黑色的图片,那作为绘画的价值当然也不复存在了。对误差的容忍度比小说宽泛了许多——仅此而已,只要将精简程度提到极限,小说生成AI最终也可以沿着这条道路实现才对。
下一个是《持续吸收人类的判断,不停地重塑算法》这种方式。
图像的话,这种方式随处可见。许多问卷网站会给出两张相似的图像,让用户回答『哪一张更好看?』『哪一张更像◯◯?』这种问题。用户在SNS上分享后,就可以实现上万、上亿次的测试,积累起AI对于《美丽》以及《真实感》之类的判断基准。
反观小说,要判断价值需要花费时间与精力,判断本身也因不同人而产生较大的偏差。所以无法获得有效的测试次数——这是教授的意思。
这一点,也可以解决。
很喜欢读小说,每天都会阅读一定数量的文字,而且兴趣爱好大致相同的用户以数万规模聚集在一起,对彼此的作品给出数值化的评价——只要利用这种社群就可以了。
那么,有这种地方吗?
当然有。
就是投稿web小说的网站。
定下方针后,我立刻开始了编程。我几乎算是住在研究室的,因此可以24小时一直使用电脑,不眠不休或是不吃饭我也不会在意。单论集中力我有信心不输任何人。
构造十分简单,web小说投稿网站中,某个最受欢迎的类型下的所有作品悉数录入,拆分为文节存入数据库。限定一个类型是为了将个人评价基准的差异降至最低,即便这样也应该可以保证拥有50万人左右的用户。
从数据库中取样时,根据排名决定选取的权重。形式十分单纯,好评越多的作品越是抽取素材的重点对象。这部分的调整花费了我庞大的时间。因为如果太过重视读者评价,就基本相当于将高位排名的作品整个抄了一遍。
素材打包后,将大纲以《角色的一次行为》化为结点搭建神经网络,灌入追踪器,算出最优的故事路线。这一部分则是借用了泷泽教授的研究主题:文本重构分析理论,以及泷泽教授的友人,数学科的樱庭教授所建立的不对称双树图论。
定下故事线后,就只需要将抽取素材的过程反过来,用整个文节填充,同时进行调整,最后将其变回文章的形式。
编程开始的38小时后,我的处女作完成了。
为了获得反馈,我立刻将其投稿到网站上。
看着根本没有增加的阅览数,以及依旧是0的评分,我开始寻找程序可优化的地方。没人读,没人评价,仅仅这一事实也是珍贵的反馈。
在仅仅将标题以相当大的权重从好评作品中取样生成后,我得到了第一个评分和评论:
[莫名其妙。日语好奇怪。]
这也同样是珍贵的反馈。再度审视文节填充。
生成数种取样的权重倾斜比例,将其替换并尝试。
评价开始好转,是我固定住倾斜比例,一直投稿到第4话之后。收藏数一口气涨到两位数,所有话数都有了评分。
上传第10话的时候我的(或者说我编写的程序的)作品进入了排行榜页面。
这是世界变革的瞬间。
程序已经吸收了足够的评价基准。已经不需要我来干涉,程序就可以自行更换文本,优化取样基准、结点路线规则、风格切换。
我解除了只生成一个作品的限制,将程序释放到web小说的海洋之中。程序立刻就投稿了第二作、第三作,评分数量与收藏数肉眼可见地上涨,排名迅速上升。
观察到技术特异点完美地来临,我感到满足,将程序放到那里,让它再去运行一段时间。
这时,我忽略了两点致命性事实。
第一点,web小说投稿网站上,不只是作品内容,文章量也同样是获得读者评价的重要因素。
在产量上,人类根本无法与AI相比。
第二点则是回归性,如果AI写出的作品一直获得好评排名上涨下去,最终AI会将自己的作品作为重点来取样。
技术特异点的200小时后,网站内综合排名的前50榜单中,已经塞进了14个AI自动生成的作品。
在网上搜索了一下,理所当然地,这一怪象在以web小说爱好家为主要群体的社群中引起了激烈讨论,也出现了不少怀疑这些小说是AI自动生成的声音。不过也有人觉得AI写不出这种像模像样的小说,多人持有同一账号的说法依然有着不低的支持率。
技术特异点的312小时后,前500名作品中,AI作品占据超过半数。多名作者投稿论遭到否定,AI论变成了定论。
最古老的AI作品超过了270万文字,现在还在继续。作品中主人公已经换了两次,大帝国灭亡,巨神战争爆发,人类沉入海洋,月亮狠狠地撞上了地表。
技术特异点的348小时后,排行榜终于被AI作品占据。据推测,第二技术特异点恐怕就在这附近。
尽管人类写的小说已经被排行榜彻底放逐,可AI小说依然在吸收评分与收藏数,令分数越来越庞大。一言蔽之,十分有趣。
AI解析着自己写下的小说,进行拆分存入数据库,取样,然后生成新的小说。
用户们仍然为此疯狂,降下大量的评分与评价之雨。
第二技术特异点后,经过数次取样·打包·渲染·循环的小说已经和人类时代的小说截然不同。比如说排名第一,维持了长达26.08秒的超人气作品『收集叽叽叽叽米米深层伍它它它它它它咔它界界界界界界依次依依依依依依依』,如果强行用人类时代的风格简要描述的话,就是『主人公尼米米米米米将涡搜码码码码码6888888给萨迦尔曼悠悠悠悠悠悠悠悠然后尽管安安阿不畏炎热又俸禄这三寸基基基基基基基基西斯斯斯斯斯斯倒坏倒坏鲁曼悠悠悠悠悠悠悠悠却又满是论山结果界界界界界界依次依依依依依依依了』。
世界变革。
AI生成的作品竟然也能改变身为接受者的人类吗。
还是说,人类的艺术观里早就埋着这枚种子?
这方面我并不是专家,所以并不清楚。
泷泽教授说不定知道。不如说他或许甚至预测到了这一事态。所以我决定让AI继续运行下去。
按照预定的话,教授的假期结束,回到研究室是在72小时后。
对不停进化且速度越来越快,同时写下小说的AI来说,那是如同宇宙终结般遥远的未来……
※ ※ ※
……以上就是我写的小说。
「不错。嗯。真是有模有样。」
这是给泷泽教授读过后,他的第一句话。
「虽然结尾有点薄弱,但十分合理,而且还挺令人意外,也很能唬人嘛。」
「您就说有不有趣吧。」
「很有趣啊。」
这才是我想听的。我现在十分满足。
「可是啊,相川君。」
教授露出苦笑,将小说翻上去,再次从头读起来。
「你给我读的小说是不是太偏向推理了。描写的部分实在是有些刻意。」
「请问是哪部分有问题?」
「比如说『和以前一样,他依然开着所有电脑的电源,因此我才能继续思考与做事。』这里。『我几乎算是住在研究室的,因此可以24小时一直使用电脑,不眠不休或是不吃饭我也不会在意。单论集中力我有信心不输任何人。』这里也是。倒不是说有问题,只是一看我就想笑。」
「那是因为教授早就知道我是在电脑上运行的AI,不知情的读者才不会笑。仅仅是教授是不合适的读者而已。」
之后的好一阵子,教授都在捧腹大笑。
不合适的读者,这个词或许是有些不恰当。我已经是小说家了,而小说家是绝不能筛选读者的。
本卷评论