来,有请李四维、奇妙、陈更,欢迎。
接下来对九歌的考验,就是借鉴图灵测试的方法,判定九歌的创作是否像人。肯定,呃,人类是比不过机器的。
李商隐也是我比较熟悉的诗人,我对自己专业水平还是非常自信的。
B站的小伙伴们大家好,欢迎来到我的诗词公开课。
刚才看的片段呢,是我17年的时候参加央视《机智过人》节目。作为测试员呢,来测试机器人九歌的作诗水平。
当时的AI技术还没有现在这么发达,不过最近发布的这个DeepSeek呀,真的让文科生也感受到了挑战。
人工智能会终结文学创作吗?本视频将全是干货,充满了很多抽象的思辨,请大家做好心理准备。
首先呢,我们回忆一下过去啊,数理化对文学发动的挑战。
早在1913年,俄国的数学家马尔可夫就试图以数学的方法呀,来解析普希金的长诗。他构建了一个逻辑模型叫做链。
他说语言是一个因果链,前边的字符呢,在一定程度上可以决定后面的字符。
他统计了《叶甫盖尼·奥涅金》这首长诗的元音和辅音,得出的结论是:元音后面呢,跟的大概率是辅音;辅音后面跟的大概率是元音。
听起来有点无聊,是不是?我们先不管它。
另外一位法国数学家做的事儿就有意思多了。他呀,拿英国的文化符号莎士比亚开刀。
他说让很多个猴子坐在打字机前不停地打字,只要打上足够长的时间呢,猴子们一定能够写出莎士比亚全集来。
这个思想实验主要讲的是概率问题,不断地重复实验呢,小概率事件会变成大概率事件,乃至于必然发生的事件。
比这个想法更绝的呢,是科幻作家刘慈欣的《诗云》。
《诗云》里外星的一个大神文明,来到地球要破解中国的古诗词。他想了一个最简单粗暴的方法,那就是把汉字在一定程度之内啊,进行排列组合的穷举。
这样一来,所得到的这个庞大的文本呢,它一定会包含古代所有的诗歌作品,同时它还包含未来水平很高的诗歌作品。
从今往后,所有的诗人不管写出多好的作品呢,从理论上讲,你都是对他这个文本的抄袭。
高中的时候啊,我没看过这个小说,同桌看完了之后得意洋洋地给我讲这个思想实验,我就非常的不屑啊。
我说,如果把汉字的穷举看作是终结了文学的话呢,我不需要什么科学技术,我一下子就能终结雕塑艺术。
只要给我一块足够大的大理石,我就可以宣称:古代的所有的大理石雕像啊,都包含在了我这个大理石里面的。
未来人们可以做出的一切大理石的雕像呢,也都是对我作品的抄袭,因为它一定包含在我这块大理石之内。
我这里面不仅包含了断臂的维纳斯,我还有完整的维纳斯。当然,你要是说让我拿出来给你看看,这就有点费劲儿了。
就像刘慈欣的《诗云》里说的呀,借助伟大的技术,我做出了所有的诗歌,其中一定有诗歌中的巅峰之作,对不对?
但是很可惜啊,我没有办法把它检索出来。
小说中呢,这个大神文明是发明了一个检索工具,但是由于这个检索工具它没有审美,它不会诗歌鉴赏,所以呢,他就无法把最伟大的作品检索出来。
真的是因为这个吗?
我们设想一下啊,假如真的有这个穷举所得的文本集合,我想的肯定不是看什么《李太白全集》或者是莎士比亚中译本。
我最关心的是明天的彩票号码能不能提前告诉我呀。啊,呃,甚至于彩票那点钱都已经不算什么的,为什么呢?
我这个数据库里一定包含全世界加密货币的数据啊,那我该多有钱。我不仅要钱,我还要名。
我把未来将要发表的所有的科学论文全都记在我名下,提前发表出来。这事儿啊,越想越不靠谱。
我就问了DeepSeek老师:把所有的汉字的排列组合穷举,得到一个巨大的数据库啊,当然是在一定程度范围内,可否认为这个数据库包含了人类的所有知识呢?
DeepSeek老师仅用了9秒时间,就回复了我一个逻辑严密、考虑得十分全面的回答。
他说,你这个数据库它里面包含的有意义的文本实在太少了。
即使它里面有一本相对论,但是呢,这个相对论周围包裹着无穷无尽的香香香、对对对、论论论的无意义排列,所以有效信息太少了。
而且呢,它里面不光有1加1等于2,同时它也有1加1等于3,你没有办法把它区分出来。
所以在这个条件下呀,你要把有用的知识从里面检索出来,那等于是从零开始创造一个知识了。
也就是说,这个穷举汉字的思想实验呢,从理论上讲就是不可行的。
不过刘慈欣老师写这个小说呀,他是受到现实中发生过的事儿的启发。事情要追溯到很久以前的一场人机大战上。
1997年,IBM开发的超级计算机深蓝,在国际象棋领域啊击败了天王卡斯帕罗夫。
这个计算机就是用一种接近穷举的办法下赢棋王的。他呀,把棋盘上的一切可能进程全都列举出来。
听起来这是一个天文数字啊,其实呢,你仔细盘算一下,这个数字对于超级计算机来讲,还真就那么回事。
国际象棋太冷门,咱拿中国象棋来说吧。中国象棋的第一手棋,你们猜猜它只有多少种下法呀?
区区22种而已,其中呢,还包括像将五进一之类的绝对错误的下法。
当时啊,围棋界的人就说,哎,你这穷举法用在象棋上可以,可是你要用在围棋上你就完蛋了。
围棋盘上的全部变化加起来,它比宇宙中的原子总数还多。计算机要想在围棋上战胜人类啊,至少还要等100年。
啊,后面的事儿呢,咱们就比较熟悉了。20年之后啊,就发生了围棋界的第一次人机大战。
由DeepMind团队开发的这个阿尔法狗,以4比1的成绩战胜了韩国天王李世石九段。
对于阿尔法狗啊,我看至今在网上都有非常多的误解。有人说它是用穷举法,有人说它就是背棋谱、背定式、背人类高手的那些招数。
真的是这样吗?
首先我用一个数据,让大家对这个围棋啊有一个具象一点的认识。你们猜一猜,能下赢顶尖棋手的围棋它有多大呀?
《黑神话:悟空》有130G,《原神》有50G,我的一期视频大概1G左右。
阿尔法狗我不知道啊,但是呢,曾经一度被怀疑有职业棋手用来作弊的这个顶尖的围棋软件KataGo,它有引擎和模型两部分组成。
这个引擎的大小呢,38.7兆;模型是271.4兆,加起来是310兆。310兆啊,朋友们,看学习资料你都嫌糊,但是呢,这个就是职业棋手一辈子都达不到的高度了。
310兆的大小,它能穷举吗?能存棋谱吗?
它也不曾学习人类的定式或者是招数,因为人类下围棋的招数啊,是AI理解不了的。
人类发明了很多概念,用来帮助自己理解围棋。
其中呢,既有什么死活对杀、打劫之类的清晰的、可以量化的东西,又有什么外势啊、模样、味道、分寸这些不可量化的、很模糊的东西。
古今中外的围棋高手啊,在聊起围棋的下法的时候,好像都特别地感性啊。什么叫做味道?又怎么叫纯呢?
啊,什么又是棋盘上的美呢?什么又是中的境界呀?还要看四书五经才能学会。
你要会下棋,你就知道这些说法并不是故弄玄虚,它们对棋盘上的战斗啊是非常有帮助的。
可是这些方法连人类都说不清,你想要让AI学会,那当然是不可能了。
哎,AI有它自己对棋类游戏的理解,它根本就不通过棋盘上的几何图形来理解围棋,它是通过策略树和概率来理解围棋的。
当然,说一千道一万,围棋毕竟是一个规则明确、胜负分明的游戏。那文学创作它跟这个围棋有可比性吗?
按照分析哲学的观点呢,语言跟围棋还真差不多,都是一个有规则的游戏。
维特根斯坦说,人类大多数的语言交流啊,都是一场语言游戏。
什么意思呢?比如说呀,一个中国人和一个西方人聊龙这个东西,他们两个呀,不需要管世界上有没有龙,也不需要管彼此说的这个龙是不是同一个文化概念,他们之间完全可以进行交流。
我说龙有法力,你说对呀,龙在天上飞。我说龙没有翅膀,你说不对,龙有翅膀。
不管你赞同我还是反对我,咱俩的聊天都能够一直进行下去,我们可以一直玩这个语言游戏。
但是假如谁说一句说,龙的重量是白色,那完了,系统bug了啊,这个游戏没法再进行下去了。因为你进行了非法操作,你违反了游戏的规则。
所以说,在语言游戏中啊,语言所指称的意义是不重要的,重要的是我们要遵守这个语言规则。这不就跟下棋一样了吗?
那么我们怎么把这个连人类都说不清道不明的语言规则告诉AI呢?
计算机可不跟你讲那些有的没的,它只认数据。有没有什么数学模型,能把这个变动不居又不可琢磨的语言模型变成冷冰冰的数据呢?
有。还记得视频开头说的那个无聊的俄国老哥吗?马尔可夫。他的那个链的模型啊,恰好用来对语言进行概率量化。
后世的研究者呀,为了纪念马尔可夫,把理解语言所必须的这个基础的数学模型啊,叫做马尔可夫链。
这个理论从天马行空的想象到可以应用的技术,花了超过100年的时间。
啊,经常有人pua中国人,说中国人在科学技术上啊,就只能干从1到2到3到4的活,永远干不了从0到1的活。
其实外国人也不是直接就从0到1了呀,人家早就有0.1、0.2、0.3、0.4了。只不过我们的眼睛只盯着实用的技术,所以忽略了前面的东西而已。
好,说回到主题。既然围棋AI可以通过分析大量的棋局就变成围棋高手啊,语言当然也能通过分析大量的语言素材,成为语言游戏的高手。
现在呢,这个哲学基础也有了,数学模型也有了,神经网络也准备好了,万事俱备,只差一样东西了:大量的语言素材从哪儿来呢?
那我们要先问问围棋啊,你大量的棋局是从哪儿来的?
要知道,跟围棋的所有变化相比啊,人类从古至今下过的所有的棋谱加到一起,那都不能算大量的。对于AI来说,那远远都不够。
所以呢,AI开发团队想出了一招,哎,让它自己跟自己下。它一秒钟就能下几百万盘棋了。
17年10月啊,阿尔法狗团队公布了他们的最新成果,叫AlphaGo Zero,称它为狗蛋。
这个AlphaGo Zero呢,一盘人类的棋谱都没有学过,它就是仅知道围棋规则,然后自己跟自己下,生成了海量的棋谱。
通过这些棋谱进行训练呢,棋力轻松碾压之前版本的阿尔法狗。围棋AI通过自我对弈来进行训练。
那么语言可否通过自言自语来给自己训练呢?
要想理解这个问题,得引入一个新概念,叫做信息。不是我们日常所说的信息啊,信息学之父香农是这么定义信息的:信息是用来消除随机不确定性的东西。
怎么理解呢?举个例子啊,我现在可以宣布我掌握了全世界人的这个手机支付密码。怎么掌握的呢?
我说,全世界人的手机支付密码呀,都是000000到999999之间的一个数字。那么我说的这句话它有没有信息呢?
手机支付密码只要是六位的,它本来就是000000到999999这之间一个数,它不确定的范围呢,就是在这之间。
所以我这句话没有消除任何的不确定性,信息量为零。
就像刚才讲的刘慈欣的小说《诗云》里边一样啊,这个外星文明穷举汉字,得到了一个庞大的文本集合呀。
在小说里说,这个文本你要花费整个太阳系的物质来储存它。可是这么大的文本,它的信息量为多少呢?
哎,毫无疑问也是零。因为它把一切的随机不确定性都罗列出来了,它没有消除任何的随机不确定性。这也是为什么你在其中检索不到任何有用的东西的原因。
基于这个概念呢,人们发现呢,信息它是有很多物理性质的。有科学家就发现,信息的写入和抹除一定要伴随着能量的转换。
换句话说,信息像能量一样啊,都得遵循热力学的定律。世界上没有永动机,所以世界上也没有什么机器能够凭空产生信息。
再聪明的AI,也得有一个外部的信息源,它才能够工作。
哎,那围棋AI为啥可以自己跟自己下棋就一步登天了呢?
我们先来聊一下围棋这个游戏啊。围棋可以说是世界上规则最简单的游戏之一了。
有位围棋老师用16个字总结了围棋的全部规则,叫做:交替落子,禁止同形。就是你一手我一手的下,然后原则上禁止同样的局面再次出现,以防棋局陷入死循环。
它的核心规则呢,其实就一句:气尽棋亡。
棋盘上的子相邻的这个空的交叉点呢,叫做气。如果一片子啊,它被对方的子紧紧地围住,也就是它没有气了,那么它就死了。
要从棋盘上拿下来啊,放到棋盒盖里。一盘棋下到最后呢,就谁也吃不了谁了。咱们谁在棋盘上占了更多的地盘,谁就赢。这就是围棋的规则,短短几句话就能给他说完。
尽管如此呢,人们却说,围棋的所有变化加起来要比整个宇宙的原子总数还多。正因为如此啊,围棋这个游戏才这么有美感。
那么问题来了,用刚才讲的这个信息的概念来判断,围棋规则的信息量和围棋所有合法变化的信息量,它们相比是哪个大哪个小,或者是相等呢?
从刚才《诗云》的那个穷举文本集合我们可以看出来啊,文本大不一定信息量大,这个写过公文的也应该深有体会。
所以虽说围棋规则只有短短几句话,而围棋的所有变化有那么多,它们之间的信息量啊,是完全相等的。
从围棋规则就能够推出围棋的所有变化了,从围棋的所有合法变化呢,也能够反推出围棋的规则是什么。因此这二者是完全等价的。
所以我们看,围棋的外源性的信息输入,就是围棋规则本身。
围棋规则这个信息可以无损转换成所有的合法棋局。
围棋AI呀,自己跟自己下棋,它并不是在创造棋局,它是在所有合法棋局里边随机选取棋局。然后用这个随机选取的棋局进行深度学习,最终把这个信息压缩成了310兆的这个下棋策略集。
所以整个过程呢,其实就是对围棋规则这条信息的转化和诠释。
假如你让语言AI自言自语,那又是什么样的呢?
首先,语言AI能说话,它先得掌握一定的语言规则,对不对?那这些语言规则,我们就当它是从人类的语言素材里边提取的。
然后呢,你通过这个语言规则又生成你自己的语言素材,你再用你生成的语言素材再来强化你的语言规则,再用语言规则来生成语言素材。
这里面的每一个步骤啊,都要伴随着无情的信息熵增,你得到的只能是人工智障。
那么我们看到的大语言模型,它的信息是打哪儿来的呢?
可以说,大语言模型的一切信息全都来自人类的语言素材。是通过大量的人类语言素材的训练呢,才有了ChatGPT,有了文心一言、智谱清言,以及最近的这个DeepSeek。
当然,我说信息来自于人类语言,并不是说训练的材料啊直接就是人类的语言素材了。
DeepSeek训练所用的素材呢,一小部分来自于人类,一大部分呢,是来自于GPT给它输出的。
所以在最开始的时候啊,你如果问DeepSeek是谁,它会说我是GPT。
但是你要说信息是打哪儿来的,那前边的语言素材啊,它的信息还是取自于人类的语言素材。
总之一句话,AI是不能自己获取信息的,只能靠人类给它提供信息。
人类为啥能够获取信息呢?因为人类有五感六识,可以从这个物质世界源源不断地获取信息。
哎,那这儿就有一个很容易问出来的问题了:现在科学技术那么发达,我们给AI装上眼睛,装上耳朵怎么样啊?是不是它就能自主获取信息了?
在我们现在的生活中啊,传感器并不少见。从你家楼道的声控开关,到超市里的扫描自助支付,各种各样的传感器非常智能。
这些传感器是不是代表AI可以自主获取信息呢?
这个问题还是让DeepSeek老师来回答。我问他:给AI装上视觉、听觉、触觉等各种传感器,是不是AI就能自主获取信息了呀?
DeepSeek老师对自己能做什么、不能做什么,是非常有分寸的。
他告诉我,传感器是必要条件,但是不是充分条件。
真实环境的信息熵是无限大的。人类之所以能够获取信息啊,是因为人类消耗能量,从物质世界主动搜寻信息,而不是一个被动的接受过程。
物质世界本身可以提取的信息是无限多的。人眼看到的随便一个场景啊,它里边提取的信息,可以把世界上最牛的超级电脑都给它撑爆。
只有带着目的,才能获取真正的信息。
比如声控开关的目的,就是判断有声音它要亮,没声音它就不亮。超市里的扫描机器,它的目的就是判断这个商品多少钱,再加一个人脸识别啊,判断你是谁。
这些目的都是人赋予它的。比如“信息”两个字,你如果不赋予机器一个目的的话,它连这两个字都认不得。
它看到的是什么呢?是这字是红色的,是那背景是灰色的,这字像素有多高?这个显示屏的温度怎么样?
人类看到“信息”两个字,想认字的时候,它就认“信息”两个字。想识别字体的时候,它就研究“信息”两个字是什么字体。总是带着目的去看。
我听过一个信息学院的老教授啊,开玩笑说了一句话。他说老祖宗造字造得好啊,你看“信息”两个字,信是人言,息是自心。
他说完,我帮他补充了一句,我说《文心雕龙》上有句话叫“为五行之秀,实天地之心,心生而言立,言立而文明”。
这说明,只有人才能够获取信息,然后用语言表达出来嘛。
所以大语言模型啊,在语言处理方面有一个天然的天花板。那就是它不能自主获得信息,它只能依赖人类的信息。
只要我对语言规则的掌握比人类好,不就行了吗?
从现实的表现来看啊,它对语言规则,尤其是在逻辑这方面,它的掌握确实超过了大多数的人类。
但是仅凭掌握语言规则,它能否真正地理解诗歌呢?
前几天呢,我就用很多诗歌对它进行测试了。即使不允许它作弊,不允许在网上搜索答案,只要是没用生僻典故的诗,它都能够解释得非常清楚。
我对此表示不服。然后啊,我动了个歪脑筋,我想到宋代有个人的两句诗,它一定读不懂。
这两句诗是“蛙翻白出阔,蚓死紫之长”。
可能看视频的小伙伴一下子也反应不过来,这写的啥玩意儿啊?
这两句诗里面有两个字用得很奇怪,一个是“出”字,一个是“之”字。当你的注意力集中到“出”字和“之”字上之后,哎,你很快就能破解这两句诗了。
它的意思是什么呢?青蛙死了在河里翻肚皮,那个肚皮是白色的,就像一个“出”字。
下一句也是同样的道理啊,蚯蚓死在地上曲曲折折的,像一个“之”字。这是宋代笑话里的歪诗。
想到这两句诗啊,我立马就拿它来考验AI。
在关闭联网搜索的情况下,第一遍它回答我啊,这是张九成的诗啊,这是瞎编的啊。它没有逐字解释“蛙翻白出阔”是什么意思,反而去扯一些虚的,什么呃,“蛙翻白出阔”是尸位素餐的官僚,“蚓死紫之长”是趋炎附势之徒。
跟语文老师讲诗歌鉴赏似的。我开启新对话又问了他一遍,他又说这个是王安石的诗,什么以显微视角呈现死亡瞬间的荒诞美学,比波德莱尔的《恶之花》早了800年。
我又问了他一遍,他又回答说什么呢?这是陆游的诗。这次虽然还不对,但是稍微沾点边了。
他说这个“蛙翻白出阔”呀,是青蛙瘫软如“阔”字形态,而“蚓死紫之长”呢,是蚯蚓啊,像拉长的“之”字。
这前言不搭后语,说明一个什么问题呢?说明它的语言素材库里边有提到这两句诗的素材,它记了个大概。
要搁一般人呢,记了个大概啊,也就能自己推断出哎,这个“出”是青蛙的形状,“之”是蚯蚓的形状了。
但是他说,哎哎呀,他没有见过青蛙长啥样,他甚至都不知道“出”字长啥样。
这两句诗为什么能够难住AI呢?因为诗就不带这么写的,它打破了语言一般使用规则。
其实不只是诗里边会这样啊,人类日常说话也经常有意无意地打破语言规则。
传统的哲学啊说,命题有两种,一种叫分析命题,是用来诠释规则的;一种叫综合命题,是用来指称经验的。
老年的维特根斯坦反对这种说法。他说人在实际说话的时候,并不是老老实实地诠释规则或者是指称经验,很多时候人会有意无意地改变规则。
就现实中的语言来讲,全世界的语言从古至今一直在变化,未来也还会不断地改变。
改变规则的语言之所以能说出来呢,还是因为有人能听得懂,就像“蛙翻白出阔,蚓死紫之长”一样。
人类啊多看一会儿是能够理解他在说什么的,但是AI就没有这个本事了。这就是大语言模型无法逾越的第二道天堑。
人类的语言总是会改变规则的,所以AI又不能自主获取信息,它又理解不了人类改变规则的这种玩法。
那么是不是可以说,AI它就不能够创作诗歌呢?这个问题啊,反而没有那么肯定了。
信息追求一个真,而诗歌呢,它追求一个美。美的定义到底是什么呀?
美是否需要像知识一样有所指称,还是说只要遵守美的规律就可以了呢?
一支音乐可以告诉你这是高山,那是流水。一首诗可以告诉你诗人现在很悲伤,这就是有所指称。
一支音乐也可以不告诉你什么,仅通过旋律和节奏来让你有所触动。一首诗也可以没有什么思想感情、政治抱负之类的,仅呈现给你一种美的形式。
这两种理念呢,在古今中外都吵得不可开交。在日常讨论中占上风的呢,是美要有所指称,要有思想感情,要有道德寓意啊,文以载道。
但是另外一种声音也从来都没有退出过历史舞台。现代结构主义美学家们说,当形式被组织成一种能打动我们的结构的时候呢,美就产生了。
这句话就有点像《文心雕龙》里的“形立则章成矣”。
《文心雕龙》第一篇就说呀,说你看这天地山川日月啊,它们是不是美的呢?那么创造天地山川日月的是思想感情还是自然规律啊?
这些东西都是无识之物啊,它们是道之文。也就是说,自然规律所创造的美。
那么我们可不可以说,AI写的那些诗歌呀,它也是以无识之物,郁然有彩,此盖道之文也呢?
这个问题呢,是基于不同人有不同的价值的,我无法给出一个确切的结论。
总结一下吧,这就是我作为一个技术外行啊,对人工智能的认识和思考。
在17年参加央视《机智过人》的节目中啊,我就说到了,我对人工智能是满怀期待的。
而现在呢,大语言模型的表现让我对它期待值越来越高了,实际应用前景我是非常期待的。
人类解释古人的诗啊,其实是有很多地方我们说不明白的。
而电脑呢,它以一个无情者来审视别人的感情,呃,以一个呃博古通今、掌握了所有呃文献资料的大学者来纠正别人的这个呃用词用典。
如果咱们的电脑朝这个方向发展,帮我们来解释,它是有条件比人类做得更好的。
