上一问的结尾说,看见技术怎样过滤问题,需要一种能看见媒介本身的能力。可媒介恰恰是最难看见的东西,因为我们是透过它看的。
我们每天都在看世界:打开手机,刷新闻,看短视频,搜索一个问题,读一篇文章,听一段播客,看朋友发来的照片,让 AI 总结一份报告。这些事情看起来都很普通,普通到我们很少意识到一件事:我们几乎从来没有直接看见过世界。我们看见的是屏幕上的世界,新闻里的世界,朋友讲述的世界,摄影机拍下的世界,搜索引擎排列出来的世界,推荐算法筛选出来的世界,模型生成出来的世界。
我们以为媒介只是把世界送到眼前,但它做的事情比传递复杂得多:它决定什么能够出现,什么先出现,什么被放大,什么被压缩,什么被重复,什么被遗忘,甚至决定什么东西根本不会进入我们的视野。所以真正的问题从来不是媒介有没有改变我们看到的信息,而是:如果我们认识世界的入口本身发生了变化,我们所说的世界,还剩下多少没有经过媒介?
一窗框决定你看见什么
一个人站在窗前看外面。他看见的是外面的一部分,由窗框切出来的那一部分。他很少注意窗框,因为窗框不是他要看的东西,他注意的是外面。可是外面有多大、什么在里面、什么在外面,是窗框定的。

媒介就是这样的窗框。它把一部分世界送到你眼前,你看见的是世界,而不是窗框。这一问的每一位思想家做的都是同一件事:让人注意到窗框。他们每一位都在一种新的媒介刚出现的时候,看见了它正在改变的东西——而通常,只有在那个短暂的时刻,窗框才是可见的。
二柏拉图:洞穴里的影子
柏拉图留下了两个关于媒介的原型。一个是塔穆斯对文字的批评:文字让人不再从内部回忆,得到的是智慧的外表而不是智慧。另一个是《理想国》第七卷的洞穴:一群人从出生起就被绑着面对墙壁,身后的火光把经过的东西投成影子,他们一生只看见影子,于是影子就是他们的世界;谁转身看见了火和外面,回来说的话他们不信。

这个故事通常被读成关于真理的寓言,但它还有一层极其现代的含义。洞穴里的人不是没有视觉,他们看得非常清楚,甚至可以准确描述墙上的每一个影子;问题在于,他们看见的东西本身就是经过某种机制产生的。今天的媒介环境与它惊人地相似:我们看到的新闻、热搜、推荐、视频、AI 回答,都是真实的信息,但它们同时也是经过某种机制选择、排列和呈现之后的信息。于是现代人的处境非常接近柏拉图的追问:我们看到的究竟是世界,还是世界经过某种媒介之后留下的影子?而被媒介塑造的人很难知道自己被塑造了,因为他没有别的世界可以比较。
三决定什么能够进入视野
想象一个没有媒介的世界。你站在城市街头,只能看到眼前的人,听到附近的声音,知道身边发生的事情,世界非常小。后来报纸出现,一个人第一次可以知道昨天另一座城市发生了什么,一场战争在哪里进行,一个国家正在发生什么政治变化,一个陌生人的观点是什么。媒介突然把人的感知范围扩大了,这是现代社会最伟大的变化之一。
但扩大感知范围的同时,媒介也必须进行选择。一份报纸不可能刊登世界上所有事情,编辑必须决定什么值得报道,什么放在头版,什么放在第十版,什么只写一段,什么完全不写。于是媒介拥有了一种非常特殊的权力:它不需要告诉你应该相信什么,它只需要决定什么值得让你看到。
四李普曼:脑中的图景
1922 年,沃尔特·李普曼出版《公众舆论》,提出了一个重要的观察:现代社会太复杂,一个普通人不可能亲自观察战争、政府、经济、外交、企业与科学,于是我们只能通过新闻和其他媒介,形成关于世界的脑中图景。
这意味着,人们对现实的判断往往建立在对现实的间接经验之上。你没有亲自去过战场,没有参加中央银行的会议,没有进入一家跨国公司的董事会,没有观察一场国际谈判,但你依然会对这些事情形成判断,因为媒介把远方发生的事情带到了你面前。这解决了现代社会一个巨大的认知问题:人终于能够知道自己无法亲自看见的世界。但它同时创造了另一个问题:当绝大多数公共现实都必须经过媒介才能进入我们的经验,谁控制媒介,谁就拥有塑造公共现实的能力。这是媒介权力的起点。
五爱森斯坦:能指着同一页说「你看」
爱森斯坦研究了印刷术之后的一百年,认为它最深的效果不是数量,是固定性。手抄本每一本都不同,错误随着抄写累积,地图和图表无法可靠复制,学者要跨越欧洲去看原件。印刷让同一个文本以同样的形式出现在几千个地方,读者可以指着同一页争论,错误被发现后可以在下一版改正。

她认为科学革命、宗教改革与民族语言的标准化,都建立在这种固定性上。媒介改变的不只是人看见什么,还有人能不能指着同一样东西说「你看」。一个共同的世界,需要一种让所有人看见同一页的媒介。这一点,在后来的媒介里变成了问题——而这一问最后的形状,正是围绕它展开的。
六麦克卢汉:世界开始按画面发生
麦克卢汉在《理解媒介》(1964)里把媒介定义为人的延伸:轮子延伸脚,文字延伸眼睛,电子媒介延伸整个神经系统。每一种延伸都改变感官之间的比例,而感官比例的改变就是世界的改变。他的口号「媒介即讯息」说的是,一种媒介真正的效果是它带来的感知方式的改变,与它传递的内容无关。

二十世纪中期电视成为大众媒介之后,这件事变得肉眼可见。新闻不再只是文字,战争可以被看见,政治人物可以被看见,灾难可以被看见,名人可以被看见,一个事件是否重要,越来越与它是否具有视觉冲击力联系在一起。于是复杂的过程需要被压缩成画面,漫长的因果需要被压缩成几分钟,抽象的政策需要被转化成个人形象,复杂的历史需要被转化成一个可以理解的故事。电视不只是让世界被看见,它让世界变成一种适合电视观看的世界,而我们开始按照媒介的形式理解事件。
七当一个事件必须适合传播
一个事件发生以后,如果没有人看到,它仍然发生。但如果它需要进入公共空间,它就必须被记录、被拍摄、被描述、被剪辑、被标题化、被分类、被传播。
到了社交媒体时代,这套机制更加明显。一个事件如果适合拍成十五秒视频,它就更容易进入信息流;一个观点如果可以压缩成一句话,它就更容易被转发;一场复杂的争论如果可以变成对立的两方,它就更容易获得注意力。于是媒介开始产生一种反向的力量:现实开始适应媒介。人们拍摄不再只是为了保存记忆,而是在拍摄适合被发布的记忆;人们表达也不再只是为了表达,而开始考虑这个观点能不能被转发,能不能成为标题,能不能成为一个梗,能不能在三秒钟内让人停下来。媒介到这里已经不只是记录现实,现实开始按照媒介的逻辑塑造自己。
八波兹曼:什么样的话能被说出来
波兹曼比较了两个时代的公共话语。十九世纪的美国,普通人可以站着听林肯和道格拉斯辩论七个小时,因为印刷文化训练出的头脑习惯于长的、有结构的、需要跟着走的论证。电视不能承载这种话语,它的形式要求图像、速度、情绪和不断的切换,所以一切进入电视的东西,新闻、政治、宗教、教育,都被改造成娱乐的形式。不是有人决定要这样,而是媒介的语法只允许这样。
这件事比内容的变化更深,因为它落在语言上。报纸时代需要标题,电视时代需要口播,互联网时代需要链接,社交媒体时代需要短句,短视频时代需要前三秒,搜索时代需要关键词,而生成式 AI 时代,我们开始学习如何把问题写成机器能够理解的提示词。每一种媒介都会奖励某种表达方式:长文章奖励连续的论证,短视频奖励快速进入主题,社交平台奖励容易互动的表达,搜索系统奖励容易被检索的语言,推荐算法奖励能够获得反应的内容。于是我们开始学习用媒介喜欢的方式说话,久而久之,媒介的表达逻辑进入我们的思维逻辑,我们开始习惯标题化、标签化、短句化、观点化、情绪化、可传播化。哈夫洛克曾经指出,字母表让语言可以被写下来摆在眼前,人第一次能站在自己的话外面检查它,于是有了「正义本身」这种东西——媒介让一种以前不存在的思想成为可能,也可以让一种思想变得难以被说出。它决定什么样的话能被说出来,于是决定什么样的想法能被想到。
九德波:一切都成了表演
1967 年,居伊·德波出版《景观社会》,说现代社会的全部生活都表现为景观的堆积,直接经验退化成了表象。景观不是图像的集合,而是人与人之间被图像中介的社会关系:你通过看别人的生活来体验生活,通过图像来认识你从未去过的地方、从未见过的人,而图像是被生产出来的,服务于生产它的人。

这个判断今天显得格外准确。我们通过图像认识城市,通过视频认识战争,通过照片认识别人的生活,通过短视频认识一个行业,通过社交媒体认识一个人,通过宣传片认识一家企业,通过品牌故事认识一种生活方式。我们与现实之间,多了一层越来越厚的可观看世界:一个人真正经历的生活和他展示出来的生活可以完全不同,一座城市真实的复杂性和旅游视频里的城市可以完全不同,一场战争的完整历史和流传的十秒钟画面更不可能相同。景观的特点是它不需要说服,只需要被看,被看就是被接受。于是问题变成:当被展示的世界比真实世界更容易进入我们的注意力,我们最终会不会开始生活在可展示的现实里?
十鲍德里亚:值得经历,还是值得记录
媒介还有一个更私人的层面:记忆。在摄影出现以前,记忆主要依靠人的大脑;照片出现以后,记忆有了外部存储,我们开始拍下第一次旅行、孩子第一次走路、毕业、婚礼、生日与日常生活。照片帮助我们保存过去,但也悄悄改变了我们记住过去的方式:我们越来越容易记得被拍下来的东西,而没有照片的瞬间更容易从公共记忆中消失。短视频让这个变化进一步加速,我们不只是保存经历,我们开始在经历发生的同时考虑如何记录它。于是值得经历的事情和值得记录的事情开始重叠:一个夕阳究竟是美,还是因为它适合拍照?一次旅行究竟令人难忘,还是因为它最终产生了一组好看的照片?

鲍德里亚把这条路走到了尽头。他描述了图像的四个阶段:反映真实,遮蔽真实,遮蔽真实的缺席,最后与任何真实无关,成为自己的纯粹拟像。在最后一个阶段,地图先于领土,模型先于事件:人们对一个地方的认识来自它的图像,去了之后拿图像去核对现实,而不是反过来。他说这话的时候还没有推荐算法和生成图像,但他描述的那种更相信图像而不是原型的状态,此后成了常态。媒介改变我们看见的世界,在他这里是:世界被它的图像替换了,而我们不再想要原来那个。
十一从我看见世界,到世界来找我
传统媒介有一个明显的结构:编辑决定今天有什么,电视台决定晚上播什么,读者打开报纸,看到编辑选择的世界。互联网第一次改变了这个结构,搜索引擎让用户主动寻找,你想知道什么就搜索什么,人的主动性似乎增加了。
推荐算法又完成了一次变化。现在很多时候不是你寻找信息,而是信息寻找你:你不需要搜索下一条视频,系统会自动播放;你不需要寻找下一篇文章,系统会推荐;你甚至不需要知道自己想看什么,系统会根据过去的行为推测你大概会喜欢什么。于是媒介的结构发生了一次根本变化,过去是我去寻找世界,现在是世界来找到我。而这个世界究竟是哪一个世界,取决于系统如何理解你。
十二注意力是通往现实的入口
假设网络上存在一百万条内容,你不可能全部看见,因此任何信息系统都必须筛选。过去是编辑筛选,现在是算法筛选,这看起来只是效率问题,实际上关系到一个更深的事实:人的现实经验本来就是有限的。你看到什么会影响你想到什么,你想到什么会影响你关心什么,你关心什么会影响你做什么。
所以一个系统只要改变什么首先出现在你面前,就已经在影响你的世界。它甚至不需要告诉你应该相信什么,只需要让你多看到这个,少看到那个,反复看到这个,很少看到那个。注意力于是成为通往现实的入口,谁能够影响注意力,谁就能够影响现实在人脑中的形状。
十三帕里泽:每个人一个窗
这是社交媒体时代最奇怪的现象之一。两个人生活在同一座城市,同一天醒来,使用同一个互联网,却可能看到完全不同的世界:一个人的信息流里是经济、科技、投资与创业,另一个人的信息流里是娱乐、明星与生活方式,第三个人看到的是政治、战争与社会冲突,第四个人看到的是体育、游戏与汽车。他们甚至会产生一种感觉:你说的事情,我怎么从来没有见过?

帕里泽把这件事称为过滤泡:两个人搜同一个词,得到不同的结果;刷同一个平台,看到不同的事件。过去一个社会虽然存在不同观点,但人们通常共享一部分公共信息,大家看同一份报纸,看同一场电视新闻,听同一个广播,于是至少拥有一些共同的事实背景。爱森斯坦说印刷的固定性让人可以指着同一页争论,推荐系统让这一页对每个人不一样。这是媒介史上第一次,窗框不只是切出世界的一部分,而且对每个人切的不一样,而它发生得很安静,因为每个人的窗里都很完整。
十四过滤气泡真正危险的地方
过滤泡通常被理解成:算法不断推荐你喜欢的内容,于是你越来越少接触不同的观点。这当然值得关注,但更深的问题是另一件事:我们可能开始无法意识到自己身处其中。
如果你知道自己生活在一个信息有限的环境里,你还可以主动去找别的世界;但如果算法把你的信息环境包装成这就是世界,问题就不同了。你看到十条关于某个话题的内容,它们都支持同一种观点,你会自然地认为大家都这么想;另一个人看到完全不同的十条,他也会得出大家都这么想。于是两个人面对同一个世界,却拥有两个不同的「大家」。这不是简单的意见分歧,它触及公共现实本身:我们是否还拥有足够多的共同对象,可以一起讨论?
十五窗里的是画出来的
生成式 AI 把这件事又推进了一步。推荐系统是从已有的内容里为你筛选,你看见的东西至少存在于别处,别人理论上也能看见;生成系统为你生成一个回答、一张图、一段视频,那是为你这一个人合成的,不存在于任何别人的窗里。窗框决定你看见什么,柏拉图就知道;窗里的东西对每个人不同,帕里泽看到了;窗里的东西是为你一个人画的,这是新的。

过去的媒介主要负责把世界呈现给我们,AI 在做另一件事:根据我们,为我们生成一个关于世界的解释。搜索引擎告诉你这里有十个网页,AI 告诉你我已经替你读过了,这个问题可以这样理解;传统媒体给你一篇文章,AI 可以根据你的背景重新解释这篇文章;传统视频给所有人同一个画面,AI 可以根据你的问题生成不同版本的说明。一个学生看到适合学生的解释,一个投资人看到商业解释,一个工程师看到技术解释,一个孩子看到儿童版本。这极大地提高了信息的可理解性,同时让前面每一位思想家的担忧都到了极点:柏拉图的洞穴,影子现在是按每个囚徒的喜好投的;哈夫洛克说字母表让人能站在话外面检查它,可一段为你生成的话,你拿什么去检查;鲍德里亚的拟像,现在连图像的原型都不需要曾经存在过;爱森斯坦的固定性彻底翻转,没有两个人看见同一页,而且每一页都只出现一次;德波说景观是被安排给你看的,现在安排的人是一个从所有人身上学出来的系统,它安排得比任何人都准。
十六过去的媒介有编辑,今天的媒介有模型
传统媒体的选择通常可以追溯到某个机构:谁编辑的,谁写的,谁决定上头版,你都可以追问。互联网平台的排序更加复杂,但至少我们还知道,平台的算法在工作。AI 则让中介进一步隐形:你提出一个问题,模型替你搜索、整理、总结、解释,最后出现在你面前的,已经不是原始世界的信息,也不只是某个编辑选择的信息,而是一个模型根据你的问题和上下文生成的世界解释。
这意味着,过去我们需要问的是谁在告诉我这个故事,现在还需要问:谁设计了这个生成故事的系统?它看过什么,没有看过什么,按照什么标准组织信息,为什么强调这一点,为什么忽略另一点。它给我的这个世界,究竟是世界本身,还是模型根据我的需求生成的世界?
十七当它能够预测你,它开始参与定义你是谁
推荐系统通过过去的行为预测你喜欢什么,AI 助手进一步预测你想问什么,而未来的系统会越来越擅长预测你下一步需要什么。这里有一个非常微妙的反转:传统媒介是你告诉它你想看什么,算法媒介是它根据你过去的行为猜测你想看什么,生成式 AI 则开始帮你表达你还没有说清楚的东西。
这很方便,但也留下一个问题:如果系统越来越擅长预测我们的偏好,我们会不会开始接受它对我是谁的定义?你经常看什么,系统就认为你是谁;你经常买什么,系统就认为你是谁;你经常问什么,系统就认为你是谁。然后系统根据这个你继续推荐,你又因为这些推荐继续行动,于是形成一个循环:行为产生数据,数据形成预测,预测产生推荐,推荐影响行为。媒介不再只是观察人,它开始参与塑造人。
十八可见性本身成为一种资源
在没有大众媒介的社会里,一个人想影响别人,需要亲自出现。今天,一个人可以被数亿人看到,一个观点可以在几小时内传遍世界,一个品牌可以瞬间获得全球注意力,一个普通人的经历也可能成为公共事件。于是可见性本身成了一种社会资源:被看见意味着获得注意力,获得注意力意味着获得影响,获得影响意味着获得更多可见性。
而没有被看见的东西很难进入公共讨论。这意味着媒介不仅分配信息,它开始分配社会现实中的可见性:谁能够被看见,谁能够持续被看见,谁有资格定义自己的故事,谁只能被别人描述,谁永远排在信息流之外。这些问题最终都会变成权力问题。
十九一个共同世界需要什么
现在回到最初的问题:我们还有一个共同世界吗?这里需要非常谨慎地区分两件事。共同世界并不意味着所有人必须拥有相同的观点,一个健康的社会当然可以存在巨大的意见差异;真正重要的是,我们是否仍然共享足够多的事实、事件和公共对象,使彼此能够发生有意义的争论。你可以认为一件事是好的,我可以认为它是坏的,但我们至少应该能够指着同一件事说,就是这个,我们正在讨论它。共同世界需要的不是统一的意见,而是共同的参照物。一个社会最危险的状态,也许不是大家意见不同,而是大家连自己究竟在争论什么都无法确认。
这并不意味着我们需要一个没有媒介的世界。媒介不可能消失,也没有必要消失,人类文明本来就是通过媒介扩大自己的感知:文字让我们继承过去,书籍让陌生的思想跨越时代,摄影让遥远的事件进入记忆,互联网让世界连接起来,AI 让复杂的知识更容易进入个人的认知。问题始终在于,我们是否知道自己正在通过什么看世界。所以一种成熟的媒介意识,需要保持几个具体的区分:看到一条信息时问,这是事实,还是某种叙述;看到一张图片时问,我看到的是事件,还是被选择出来的一个瞬间;看到一个热搜时问,它为什么出现在这里;看到一个推荐时问,这是我选择的,还是系统根据我过去的行为推给我的;看到一个 AI 答案时问,这是原始信息,还是模型生成的解释;看到一个完全不同的世界时再问一句,我是不是只是没有被推荐到那里。这些问题不能让我们回到没有媒介的世界,但它们能让我们意识到,媒介本身也是我们认识世界时必须观察的对象。
二十所以,媒介如何改变我们看见的世界?
柏拉图说,它让影子成为世界。李普曼说,它给了我们脑中的图景,也给了塑造这幅图景的人权力。爱森斯坦说,它让所有人能看见同一页。麦克卢汉说,它改变感官的比例。德波说,它让一切成为表演。波兹曼说,它决定什么话能被说出来。鲍德里亚说,它用图像替换了原型。帕里泽说,它给每个人一个不同的窗。
它们说的是同一件事的不同阶段:媒介先决定你看见什么,再决定你能怎样想,再决定所有人能不能看见同一样东西。AI 把最后一步推到了尽头,每个人的窗里是为他画出来的世界。而真正的危险不是媒介制造了一个虚假的世界,更复杂的情况是,它可以制造一个足够真实、足够完整、足够符合你的世界:里面有新闻,有观点,有朋友,有知识,有娱乐,有解释,有答案,还有一个越来越了解你的 AI。你每天生活在其中,它也越来越像你,最后你不再感觉自己身处一个媒介环境,你只是觉得世界本来就是这样。因为当一个媒介足够成功,它不会让你意识到,你正在通过它看世界。所以一个成熟的媒介时代要求的不是摆脱媒介,而是一种更困难的能力:看见世界,看见媒介,再看见媒介如何影响我们看见世界。而一个社会真正需要共享的,从来不是同一种答案,是我们仍然拥有一个可以一起看的世界,仍然能够指着同一样东西,对彼此说一句,你看。而一种能替每个人画世界的工具,一种把理性本身变成工具的东西,它会解放我们,还是控制我们,是下一问。
下一问 · Ⅵ·07当理性成为一种工具,它会解放我们,还是控制我们?→
