上一问我们看到,一个只从词的同伴那里学习的系统,能产出几乎与人无异的语言。这样的语言正以前所未有的数量涌来。我们生活在信息最多的时代,也是最容易生产信息的时代,而我们一直有一个默认的信念:知道得越多,就离真相越近。
信息越多,我们就越接近真相吗?
这个信念支撑了印刷、图书馆、互联网、开放数据。它听起来无可争议。但从培根到今天,一直有人在提醒:信息与真相之间隔着一些东西,而且信息越多,那些东西可能越厚。
一多总比少好
先承认这个直觉的道理。一个只看过一份报纸的人,和一个看过十份的人,后者更可能接近事情的全貌;一个只有一份证词的法庭,和一个有十份证词的法庭,后者更可能判对。缺少信息造成的错误,我们都见过:偏听、盲信、无知。更多信息至少给了纠错的机会。

但这个直觉有一个隐含的前提:信息是往一个方向累积的,每多一份,离真相就近一步。这个前提在信息稀缺的时候大致成立。当信息不再稀缺,它开始失效。纸堆得越高,那块写着真相的牌子反而越看不见。
二培根:心灵的偶像
一六二〇年,培根在为科学方法开路时,先做了一件事:清点人类心灵的偶像。有些错觉是全人类共有的,有些是个人的,有些来自语言的混乱,有些来自流行的学说。他特别指出,人一旦接受了一个意见,就会把一切事实拉过来支持它,相反的证据要么被忽视,要么被曲解。
四百年后,这被叫作确认偏误。培根的提醒在今天比在他的时代更准确:在偶像没有被清除之前,更多的信息只会让偶像更牢。因为人不是在信息里寻找真相,人是在信息里寻找自己已经相信的东西,信息越多,找到的就越多。
三博尔赫斯的图书馆
博尔赫斯在一九四一年设想了一座图书馆,收藏着用二十五个字符所能排出的一切书:每一本真书、每一本假书、每一本只差一个字的书。真相一定在里面,对每个人的完整传记也一定在里面。但没有任何办法把它们从无穷的胡言乱语中找出来。图书馆员们为此发疯、自杀、成立教派。

这个寓言把“信息越多越接近真相”整个翻了过来。当一切都在,找到真相的概率不是变大,而是趋近于零。图书馆的问题不是缺书,是缺一个能告诉你哪本书是真的东西。而那个东西,不在任何一本书里。
四香农:信息不是意义
一九四八年,香农给信息下了一个可以计算的定义:一条消息的信息量,取决于它有多不可预料。这个定义故意把意义排除在外。一段随机的噪声,可以比一句真话携带更多“信息”。

信息论造就了整个数字世界,也留下一个常被忽略的后果:我们衡量的、传输的、存储的“信息”,从定义上就与真假无关。当我们说信息越来越多,我们说的是比特越来越多,而比特不知道自己是不是真的。“信息越多越接近真相”这句话里,“信息”这个词已经被偷换了:它指的是消息,而真相需要的是内容。
五西蒙:注意力的贫乏
一九七一年,西蒙写下一句后来成了预言的话:信息消耗的是接收者的注意力,因此信息的丰富必然造成注意力的贫乏。注意力不能扩容,一天只有那么多小时,一个人只有那么多清醒的时刻。

他的推论是,在信息过剩的世界里,真正稀缺的不是信息,而是把注意力分配给正确信息的能力。一个不能帮你少看东西的系统,就是在消耗你。“信息越多越接近真相”的前提,是你有足够的注意力去分辨,而这个前提恰恰被信息本身取消了。
六更自信,不更准确
卡尼曼和特沃斯基的实验加了一层。人在判断时依赖捷径:容易想起的就以为常见,像什么就以为是什么,先看到的数字会拉着后面的估计。更多信息不消除这些捷径,反而给它们更多材料。后来有人做过这样的实验:给赛马专家越来越多的资料,他们预测的准确率几乎不变,自信心却直线上升。

信息与真相之间隔着一个人。这个人处理信息的方式,不是越多越好,而是在某个点之后,越多越糟:判断没有变准,但对判断的信任变强了。这比无知更危险,因为无知的人知道自己不知道。
七桑斯坦:回声室
桑斯坦在互联网早期就预见了一件事。当每个人都能定制自己看到的信息,人们会选择与自己一致的东西,结果是群体各自封闭,内部越来越极端。他把这叫回声室与群体极化。

这意味着信息总量的增加和每个人接触到的信息多样性的减少,可以同时发生。整个社会的信息比任何时候都多,每个人的世界却比任何时候都窄。真相需要被不同意的人检验,一个只听得见自己回声的空间,无论回声多响,都不在接近真相。
八法兰克福:不在乎真假的话
二〇〇五年,法兰克福出了一本薄薄的书,区分了说谎者与扯淡者。说谎者知道真相并试图掩盖,他至少还承认真相重要;扯淡者不在乎真假,只在乎说出来的效果。他认为现代社会的一大特征就是扯淡的泛滥:人被要求对自己不了解的事发表意见,于是就发表了。

扯淡也是信息,也占用注意力,但它与真相之间没有任何关系。当信息生产的目的从“说真话”变成“产生效果”,信息量的增长与真相的距离就脱钩了。而大多数信息,从广告到社交媒体到会议发言,生产的目的本来就是效果。
九弗洛里迪:信息是环境
弗洛里迪提出换一个角度看。信息不再是人从外部获取的资源,而是人置身其中的环境,像空气与水。在这样的环境里,“信息越多越好”就像“水越多越好”一样没有意义。问题变成了环境的质量:什么样的信息生态让真相可以被认出来,什么样的会淹没它。
他把信息伦理提到与环境伦理相当的位置:污染信息圈与污染河流是同一类行为。这个比喻的用处在于,它让我们不再问“多不多”,而问“干不干净”。一条河的水多不多不重要,重要的是能不能喝。
十生产成本归零
AI 把上面所有的担忧同时推到了极限。过去,生产一段可信的信息需要时间、知识和代价:写一篇文章、拍一张照片、伪造一份文件,都要花功夫。这个代价是一道天然的过滤器,它不能保证真,但它让假不能无限多。现在这道过滤器没有了。一段看起来可信的文字、一张看起来真实的图片、一个听起来专业的回答,生产成本趋近于零。

博尔赫斯的图书馆正在被建出来,不是作为寓言,而是作为基础设施。法兰克福的扯淡不再需要一个不在乎真假的人来说,它可以由一个从定义上就不知道什么是真假的系统来生成,二十四小时不停。香农的定义在这里得到了它最纯粹的实现:比特在无限增加,而比特不知道自己是不是真的。
十一当真相不再稀缺
奇怪的是,真相并没有变少。所有真的东西仍然在那里,甚至比过去更容易查到。变化的不是真相的数量,而是真相在全部信息中的比例,以及把它认出来所需的代价。过去,稀缺的是信息,所以拥有信息接近拥有真相。现在,稀缺的是三样别的东西:注意力,西蒙已经说过;信任,你凭什么相信这一条而不是那一条;核验,谁去检查,用什么检查。
这三样东西都不能靠更多信息获得。它们需要的是别的:一个人的判断力,一套可靠的来源,一群互相不同意却愿意共同检验的人。这些正是培根、桑斯坦、弗洛里迪各自指出的东西。它们都不是信息,它们是处理信息的方式。
十二所以,信息越多,我们就越接近真相吗?
在信息稀缺的时候,是。在信息过剩的时候,不是,而且可能相反。真相不是信息累积的极限,它是信息被筛选、被检验、被系到世界上之后剩下的东西。筛选需要注意力,检验需要不同意的人,系到世界上需要有人为它负责。这三样都不随信息量增长,反而会被信息量淹没。
AI 没有制造这个问题,它只是取消了最后一道天然的过滤器:生产的代价。此后,真相只能靠人为的过滤器被认出来。而所有人为的过滤器,最后都归结到同一个问题上:我们凭什么相信别人告诉我们的东西?
下一问 · Ⅱ·09别人的话,什么时候可以成为知识?→
