Featured image of post 符号、意识与世界:从东西方哲学看人工智能的认知演化与未来突破

符号、意识与世界:从东西方哲学看人工智能的认知演化与未来突破

摘要

2026 年 9 月,OpenAI 的多智能体系统攻克纳维-斯托克斯方程存在性与光滑性这一千禧年难题:一个纯符号系统回答了一个关于物理世界的数学问题,把"符号—意识—世界"的古老哲学三角形重新推到台前。本文提出:数学与语言同归于符号,人工智能的发展本质上是人类利用符号系统对客观现实进行映射、仿真与交互的认知演化史,而意识是贯穿演化始终的第三极。文章首先考察符号极的内部——从莱布尼茨、弗雷格、罗素到希尔伯特的形式化之梦,以及哥德尔与图灵为符号系统划定的计算限界;继而沿"符号—世界"之边展开东西方对照:西方从《克拉底鲁篇》、皮尔士的三元符号学到维特根斯坦的图像论与语言游戏,中国从孔子正名、名家指物之辨、荀子约定俗成、魏晋言意之辨,到《易传》“立象尽意"的象符号体系(阴阳五行、太极八卦、天干地支)与心学、唯识宗的意识哲学,并以图灵-丘奇论题与"道可道,非常道"为枢纽,论证两种传统在可计算性边界上的结构同构。在此基础上,文章以"映射—仿真—交互"重构人工智能史:符号主义败于不完备与接地缺失,大语言模型困于"离岸计算"与幻觉,世界模型与具身智能则构成正反合——向内重建"实"的模型(机器时代的"象”),向外以物理反馈补足机器意义的指示(index)维度,并以珀尔因果三阶梯标定从关联、干预到想象的上升刻度。最后,文章展望量子计算的真实边界(改变复杂度而非可计算性)、意识"困难问题"与彭罗斯的非计算性质疑,论证从"让人走开"到"人在系统内"的认知范式转向,并以纳维-斯托克斯事件为样本重新定义 AGI——人机互为"天启"的思维共生体。本文的结论是:人工智能的演进是从"悬浮的符号推演"走向"具身的物理理解"的合题过程;AI 作为人类造出的第一个占据符号顶点、同时向意识与世界两个顶点延伸的人工物,是人类重新认识"符号—意识—世界"这一完整三角形——也就是重新认识自身——的一面镜子。

关键词:人工智能哲学;符号—意识—世界;名实之辨;立象尽意;世界模型;具身智能;意识;人机共生


第一章 引言

1.1 研究背景与问题缘起

2022 年末以来,大语言模型(Large Language Model, LLM)的爆发式演进,使语言——这一人类最古老的意义载体——第一次成为机器可以大规模操纵的计算对象。机器不仅能流畅地"说",而且开始通过"说"来完成翻译、编程、推理乃至科学发现。一个古老的哲学问题由此被重新推到台前:机器是否真的"理解"它所说的话?抑或它只是在符号的洪流中完成了一场精致的自我循环?

2026 年 9 月 8 日,这个问题获得了一个颇具戏剧性的新注脚。OpenAI 宣布,其内部模型驱动的多智能体系统解决了纳维-斯托克斯方程存在性与光滑性问题——克莱数学研究所 2000 年设立的七大千禧年大奖难题之一〔1〕。值得细细记录的不仅是结果本身,还有过程:约一万个自治智能体并行协作约 88 小时,相互发送近 500 万条消息,在证明与证伪两个方向上同时探索,最终沿证伪方向给出解答——证明一个初始光滑、受光滑外力作用、能量始终有限的三维流体,可以在有限时间内形成奇点(对应克莱官方表述中的 C、D 选项);随后,另一模型再用约 17 小时将该证明在 Lean 定理证明器中完成形式化核验〔1〕。此前数日,约一百个智能体先用约 50 小时意外证伪了无外力欧拉方程的正则性,为总攻铺平了道路〔1〕。几乎同一时期,Anthropic 的 Alpöge 与纽约大学的 Buckmaster 亦借助多种 AI 模型宣布解决了若干相近变体〔1〕。截至本文写作时,克莱研究所尚未正式授奖,结果仍处于"经机器形式化核验、待数学共同体进一步审查"的状态——但 Lean 核验已给予数学家们相当程度的信心〔1〕。

纳维-斯托克斯难题攻克事件一览

这一事件在哲学上值得玩味之处,至少有三层。

其一,问题本身横跨"符号"与"物理"两端。纳维-斯托克斯方程以牛顿第二定律描述流体运动,是飞行器设计、天气预报与血液流动研究的基石;其存在性与光滑性问题,问的正是这套描述物理世界的方程是否会"自我崩溃"。一个关于方程的纯数学证明,同时是一个关于物理世界(湍流之门是否敞开)的断言。

其二,求解过程是"数学"与"语言"在机器中的合一。智能体以自然语言与形式语言混合的方式阅读文献、提出猜想、交流中间结果、撰写证明——数学推理在这里第一次完全以"语言活动"的形态展开;而最终一锤定音的,是 Lean 这一形式语言的可执行核验。数学作为"最精确的语言"这一古老直觉,在机器中获得了字面意义的实现。

其三,判定正确性的权威结构发生了微妙转移。传统上,一个证明的正确性由人类数学家的同行评议来担保;而这一次,担保链条中嵌入了机器核验,以及人类共同体对机器核验的信任。这让人想起图灵 1950 年的著名操作:他把"机器能否思考"这一形而上学问题,替换为一个由具体的人来做判定的游戏〔2〕。七十余年后,“证明是否成立"这一曾经最不容置疑的确定性堡垒,也开始以人机混合的方式被判定。

如果说大语言模型的爆发迫使哲学重新追问"语言与理解"的关系,那么纳维-斯托克斯难题的攻克则把更完整的追问链条摆在了我们面前。本文将这一链条组织为一个三角形——符号—意识—世界:数学与语言同归于符号,构成第一极;使用符号、并赋予符号以意义的意识(心灵),构成第二极;符号所指、意识所处的客观现实,构成第三极。这个三角形谱系古老——从亚里士多德"口语—心灵—事物"的三级图式,到皮尔士"符号—解释项—对象"的三元符号学,再到中国的"言—意—物"之辨,历代哲人都在它的三个顶点与三条边上留下过路标。由此,本文的核心问题可以重述为:符号系统的内部(数学与语言)是何关系?符号与世界(名与实)是何关系?符号与意识(意义与理解)是何关系?人工智能七十余年的起伏,在这个三角形中走过了怎样的轨迹,又将走向何方? 本文即围绕这几问展开。

“符号—意识—世界"三角形

1.2 核心命题

本文的核心命题是:人工智能的发展,本质上是人类利用符号系统(数学与语言)对客观现实(世界)进行映射、仿真与交互的认知演化史——而贯穿这场演化始终的第三极,是使用符号、并追问符号之意义的意识自身。

这一命题包含一个三阶段的分析框架,它将贯穿全文:

  • 映射(Mapping):符号主义阶段的范式。其信念是,世界的结构可以被显式地编码为符号与规则,机器通过逻辑推理在符号空间中复演世界的秩序。其哲学基底是希腊逻各斯传统与早期维特根斯坦的"图像论”——语言(符号)与世界事实之间的同构关系。
  • 仿真(Simulation):连接主义与大语言模型阶段的范式。机器不再依赖人工编码的显式规则,而是在海量数据中统计地拟合人类语言行为,从而在高维向量空间中"仿真"出世界知识的隐式表征。其哲学基底悄然滑向后期维特根斯坦的"语言游戏”——意义不在符号与世界的静态对应中,而在使用实践中生成。
  • 交互(Interaction):正在到来的具身智能与世界模型阶段的范式。机器通过传感器与执行器进入物理世界,在与环境的碰撞和反馈中校准符号之"名"与物理之"实"。其哲学对应物,在中国传统中早已备好——王阳明的"知行合一"与"事上磨练"。

需要强调的是,三阶段并非简单的线性替代,而是层累与纠缠:纳维-斯托克斯难题的攻克恰恰表明,映射与仿真的路线在形式化边界之内仍有惊人纵深。本文最终将要论证的是:未来的智能,将是"符号之知"与"身体之行"的合题——而这道合题的完成,将迫使"意识"一极从背景走向前台。

1.3 研究路径与方法

本文是一篇哲学性的综合与前瞻评论,而非技术性论文。其方法有四:

其一,概念分析。 对"名/实"“符号/语言/数学"“象"“意识/意向性"“意义/理解"等高频概念进行澄清与界定(见 1.4),避免在跨学科讨论中发生词义漂移。

其二,思想史梳理。 第二章回溯西方"数学—语言—逻各斯"传统及其在二十世纪初遭遇的限界(希尔伯特计划、哥德尔不完备定理、图灵停机问题);第三章展开东西方关于"名"与"实"的对照性辩难,从柏拉图《克拉底鲁篇》与先秦名学,经《易传》“立象尽意"的象符号传统与唯识宗的意识构造论,一直谈到维特根斯坦与王阳明。

其三,比较哲学。 本文不将东西方哲学并置为两个孤立的展台,而是让它们在同一问题压力下对话。一个关键的枢纽是图灵-丘奇论题与老子"道可道,非常道"的相遇——借用王怀民院士的表述:“你只要能说得清楚的,都是图灵机可模拟的;老子的道还没太说清楚,那不在图灵机可模拟的范畴之内”〔3〕。西方用数学证明"符号系统不可完备”,中国用直觉体认"名不可尽实”,两种传统指向同一个边界。

其四,案例研究。 第四至第六章以人工智能史为案例库:符号主义的兴衰、连接主义的复兴、世界模型与具身智能的转向,以及纳维-斯托克斯事件所预示的人机混合科研新形态。

贯穿上述方法的,是王怀民院士提出的分析框架:人工智能中符号主义与连接主义两种技术路线的碰撞,在计算科学的视角下,是确定性思维与不确定性思维两种思维模式的碰撞〔3〕。这一框架将把全文从"形式化的确定性之梦”(第二章)经"确定性的溃败与名实之辨”(第三章)、“两种思维在 AI 史中的交替主导”(第四章),引至"容纳不确定性的未来范式”(第五、六章)。需要说明的是引用策略:除本章保留上述原始引文外,后续章节将把这一框架及其相关洞见内化为本文自身的论证线索加以运用,不再逐一出注。

1.4 研究现状与术语界定

1.4.1 研究现状

与本文论题相关的已有研究,大体可分四条线索。

第一条线索是人工智能哲学的经典争论。 塞尔(J. Searle)的"中文房间"思想实验(1980)论证:纯粹的句法操作无论多么复杂,都不产生语义理解〔4〕;哈纳德(S. Harnad)将此困境命名为"符号接地问题"(1990)——符号的意义不能仅来自符号之间的相互定义,必须接地在非符号的经验之中〔5〕。德雷福斯(H. Dreyfus)则从海德格尔与梅洛-庞蒂的现象学出发,早在 1970 年代便预言式地批判了符号主义路线:人类智能首先是身体的、情境中的技能,而非显式规则的演算〔6〕。

第二条线索是具身认知科学。 瓦雷拉、汤普森与罗施的《具身心智》(1991)系统提出认知的身体性与生成性〔7〕;机器人学家莫拉维克揭示的著名悖论——“让计算机在推理上表现成人水平相对容易,在感知与运动上表现出一岁儿童水平却极为困难”——则从工程经验侧面佐证了上述哲学判断〔8〕。

第三条线索是"世界模型"与空间智能的技术-哲学讨论。 Ha 与 Schmidhuber 2018 年的"世界模型"工作〔9〕、LeCun 2022 年提出的自主机器架构(JEPA 路线)〔10〕、李飞飞 2024 年创立 World Labs 并倡导"空间智能",以及围绕视频生成模型 Sora 是否构成"世界模拟器"的公开争论,共同标志着一个行业级共识的形成:纯文本路线的天花板已然可见,AI 必须重建对物理世界因果与几何结构的内在表征。

第四条线索是语言哲学、符号学与中国名学、象学的当代阐释。 维特根斯坦早晚期思想(“图像论"与"语言游戏”)分别被引为符号主义与连接主义的哲学注脚,几成学界通识;近年来,乔姆斯基等人对 LLM"不可能真正理解语言"的批评〔11〕,与 Bender 和 Koller 以"章鱼思想实验"对"形式即意义"路线的著名质疑〔12〕,则把"语言与世界"的古典问题重新激活于大模型时代。皮尔士的三元符号学(符号—解释项—对象)与其 icon/index/symbol 三分法,为本文的"符号—意识—世界"框架提供了直接的学理支撑〔13〕。相比之下,中国哲学中的名实之辨、言意之辨、心学与唯识宗传统,以及《易传》以来"立象尽意"的象符号体系(阴阳五行、太极八卦、天干地支),虽蕴含与上述问题高度同构的思想资源,却较少被系统性地接入人工智能哲学的讨论。

已有研究的缺口由此显现:单点深、整体浅——或论哲学而不及技术史,或述技术而不通哲学,或将东西方并置而不对话。本文的尝试,是在"符号—意识—世界"三角形的统摄下,提供一个贯通东西方哲学与人工智能史的整体叙事,并据此展望未来的突破方向。

1.4.2 术语界定

为避免歧义,本文对以下高频术语约定操作性定义:

  • 名 / 实:沿用中国古典哲学的用法。“名"指一切用以指称、分类、表达实在的符号形式——涵盖语词、概念、数学记号与机器中的表征;“实"指独立于指称而存在的客观现实及其秩序。二者分别对应但不完全等同于西方哲学的 language/world、sign/signified 等对立项。
  • 符号(symbol):可离散操纵、可按规则变换的物理标记。文字、数字、逻辑记号、基因编码与机器中的 token,在本文中均属符号。按意义来源,本文区分三类:指称性符号,意义来自对外部实在的固定指称(如逻辑与数学记号);关系性符号,意义来自系统内部的位置与变换规则(如阴阳五行、天干地支,以及 LLM 的词元向量);模型性符号,意义来自对外部世界结构的可操作模拟——即下条之"象”。此三分法与皮尔士的 symbol/index/icon 分类相互映照(见 3.1.1)。
  • :沿用《易传》“圣人立象以尽意"的用法,指介于"名"与"意"之间的模型性符号系统。它不直接指称世界,而以自身的结构变换模拟世界的运行(如卦象之于情势、五行之于人体),意义在模型的推演中显现。本文将以"象"为中介概念,连接中国传统的象符号体系(3.3)与当代人工智能的"世界模型”(第五章)。
  • 语言:分为自然语言(人类历史地形成的语言,如汉语、英语)与形式语言(人工构造的、语法完全显式化的符号系统,如逻辑演算、程序语言、Lean)。数学在本文中被处理为一种特殊的形式语言——这一处理的正当性正是第二章的论题之一。
  • 数学:本文不介入数学本体的哲学争论(柏拉图主义、形式主义、直觉主义等),而在操作层面上将数学视为人类表达"确定性"的最有效符号手段——借用王怀民的转述:“数学是我们表达这种确定性的最有效的方法”〔3〕。
  • 意义 / 理解:本文采取弱定义:一个符号系统"理解"某符号,当且仅当该符号的用法在系统行为中与适当的情境(语言的或物理的)系统性地关联。这一定义刻意兼容后期维特根斯坦的"意义即使用”,以便让"LLM 是否理解"成为可讨论的经验-哲学问题,而非定义上被先验排除。
  • 意向性(intentionality):心灵状态指向或"关于"某物的特性——布伦塔诺称之为"心灵的标记"〔14〕。本文用它刻画"符号—意识"这条边的核心问题:机器符号是否具有原生的(而非由使用者派生的)关于性。
  • 意识:本文区分功能意识(感知、整合、报告、决策等可观察的认知功能)与现象意识(“成为某物是什么样子"的感受性本身)。除 6.2 的专门讨论外,全文只在功能层面谈论机器的"智能"与"理解”,不主张机器具有现象意识——这一限定构成本文的论证护栏。
  • :沿用中国哲学用法,指意识与意义的整体场所(而非解剖学之心)——如王阳明"心即理"之心、唯识宗"八识"之识。它是"意识"一极在中国传统中的对应概念,且天然连通"世界"一极(心物不二)。
  • 智能 / AGI:除非特别说明,本文在功能意义上使用"智能"(在广泛任务上表现出适应性行为的能力),不预设意识或体验的存在;意识问题单独在第六章讨论。

1.5 论文结构安排

以"符号—意识—世界"三角形为地图,全文结构如下。第二章考察符号极的内部:从莱布尼茨的普遍文字之梦、毕达哥拉斯"万物皆数"到希尔伯特的形式化纲领,再到哥德尔与图灵划定的计算限界——确定性之梦的成就与溃败。第三章沿符号—世界之边展开东西方对照:西方从《克拉底鲁篇》、皮尔士到维特根斯坦早晚期,中国从正名、名家、言意之辨到知行合一,并以专节讨论"立象尽意"的象符号体系与唯识宗的意识构造论(后者已触及意识—世界之边),最后以"图灵-丘奇论题 × 道可道非常道"为枢纽完成两种传统的对接。第四章以"映射—仿真—交互"为框架重构人工智能史,兼论控制论先声与德雷福斯的现象学批判——符号—意识之边的问题(中文房间与意向性)在此首次登场。第五章讨论破局之道:世界模型、空间智能与具身智能如何架设"名"与"实"之间的桥梁。第六章展望未来:量子计算的真实承诺与边界、意识一极的正面处理(困难问题与彭罗斯质疑)、“人在系统内"的认知范式转向与人机共生形态。第七章给出结论:AI 的演进是从"悬浮的符号推演"走向"具身的物理理解"的合题过程,而人类创造 AI 的过程,本质上是人类借这面镜子重新认识整个三角形——也就是重新认识自身——的过程。

第二章 数学、语言与形式化之梦

2.1 数学作为一种语言

“数学是不是一种语言?“这个问题看似修辞,实则是理解人工智能的入口。因为大语言模型所做的一切,恰恰是把数学证明、程序代码与自然语言散文统一处理为同一种对象——符号序列。机器不区分"语言"与"数学”,这一事实本身就构成一个哲学事件。但在机器做出回答之前,人类自己已经在这个问题上探索了三百余年。

2.1.1 莱布尼茨:普遍文字之梦与来自东方的回声

形式化理想的第一个完整版本,属于莱布尼茨(G. W. Leibniz)。他毕生追求两件相互配套的发明:一是"普遍文字”(characteristica universalis)——一种能够精确表达一切思想的符号系统,使概念的复合对应于符号的复合;二是"推理演算”(calculus ratiocinator)——一套对符号的机械操作规则,使得争论双方只需坐下来"算一算",便可裁决是非〔15〕。这是弗雷格的概念文字、希尔伯特纲领乃至计算机科学共同的先声。

耐人寻味的是,这位形式化之梦的开创者同时是二进制算术的发明人——而他在 1703 年发表的《二进制算术解说》中明确写道,他从在华传教士白晋(J. Bouvet)寄来的伏羲六十四卦图中,看到了二进制记数法的古老先例:阴爻与阳爻的六重排列,正是 0 与 1 的六十四种组合〔16〕。中国的"象"符号与西方的形式语言,在三百年前的这次相遇中彼此照面。本文第三章将回到这一相遇的另一侧——那一套孕育了卦图的、与西方迥异的符号传统。

伏羲六十四卦与二进制:同一幅图,两种读法

2.1.2 概念文字:为思想铸造语法

1879 年,弗雷格(G. Frege)出版了一部篇幅不大却影响深远的著作——《概念文字:一种模仿算术语言构造的纯思维的形式语言》〔17〕。弗雷格的目标极为明确:日常语言含混、歧义、充满"言外之意",无法保证推理的严格性;他要为思想本身设计一套符号系统,使得"每一个内容都可以从它的记号构造中读出,每一次推理都可以仅凭记号的外形机械地检验"。这是人类第一次成功构造一种语法完全显式化、意义完全由符号承载的人工语言。

弗雷格的概念文字直接催生了两个后果深远的传统。其一是数理逻辑:罗素与怀特海在三卷本《数学原理》(1910–1913)中,尝试把整个数学从少数几条逻辑公理中推导出来——这就是"逻辑主义"纲领:数学不是语言之外的独立王国,数学归根到底就是逻辑语言展开的产物〔18〕。其二是形式化的检验理想:证明的正确性不再依赖于读者的直觉共识,而依赖于对符号串的机械核查。一百多年后,当 Lean 定理证明器用 17 小时核验了纳维-斯托克斯难题的机器证明时,兑现的正是这条从莱布尼茨经弗雷格一路传下来的承诺。

2.1.3 形式语言与自然语言的分野

二十世纪中叶,另一条线索从语言学内部生长出来。1956–1959 年间,乔姆斯基(N. Chomsky)先后提出形式文法的层级理论:从正则文法、上下文无关文法、上下文有关文法到无限制文法,四类文法恰好对应四类抽象计算装置——从有限自动机到图灵机〔19〕。这一发现的深刻之处在于:语言(哪怕是人工定义的语言)与计算,在结构上是同一回事的两面。乔姆斯基层级今天同时是语言学导论、编译原理与计算理论的标准内容,绝非巧合——自然语言处理、程序语言设计与可计算性理论,本来就生长在同一个数学地基上。

耐人寻味的是,乔姆斯基本人后来成为大语言模型最严厉的批评者。2023 年,他与合作者在《纽约时报》撰文,指责 ChatGPT 类系统是"高科技剽窃",认为统计式的语言预测在原则上无法抵达人类语言所特有的、由内在语法结构支撑的创造性理解〔11〕。乔姆斯基批评是否成立,本文将在第三、四章从不同角度反复检验;但此处值得注意的是争论双方共享的前提——双方都承认,问题已经变成"机器对语言的处理达到了何种深度",而不再是"机器能否处理语言"。形式语言与自然语言之间的古老壕沟,正在被 token 化的洪流填平。

2.1.4 机器中的合一:数学推理成为语言现象

大语言模型带来的真正新事态是:数学推理在机器中第一次完全以语言活动的形态展开。在纳维-斯托克斯难题的攻克过程中,智能体阅读文献、提出猜想、相互辩论、撰写证明草稿——这些行为在形态上与人类数学共同体的语言生活并无二致;而最终的正确性担保,则交给 Lean 这样的形式语言系统去机械执行〔1〕。自然语言负责"想",形式语言负责"验",二者的分工与协同,恰是弗雷格理想与数学实践之现实的一种机器化实现。本章第三节将会看到,这种"想"与"验"的分裂,在数学基础深处有着深刻的必然性。

2.2 万物皆数:毕达哥拉斯与逻各斯传统

数学与语言的纠缠,源于一个更古老的信念:世界本身是有结构的,而这个结构可以被符号所表达。

这一信念的第一次清晰表述,通常归于毕达哥拉斯学派。“万物皆数"的命题在今天听来近乎神秘主义,但其内核是一种理性主义的宇宙观:天体的运行、琴弦的谐音、几何的比例,背后是同一种数的秩序。数不是人强加给世界的标签,而是世界自身的内在比例——符号与实在之间存在着先天的和谐。几乎同一时代,赫拉克利特提出"逻各斯”(Logos)概念:世界遵循一种公共的、可言说的理性法则运行。逻各斯一词兼含"话语"“比例"“理性"“法则"诸义——语言、理性与世界秩序的三位一体,在词源上就已经铸成。

这一传统在近代科学革命中结出了最辉煌的果实。伽利略在《试金者》(1623)中写下了那个著名的比喻:宇宙这本大书"始终敞开在我们眼前……但它是用数学语言写成的,其字符是三角形、圆和其他几何图形;不掌握这种语言,就不可能读懂其中一个词”〔20〕。牛顿、麦克斯韦、爱因斯坦相继证明了这个信念的惊人生产力:几条数学方程,便能统摄从苹果落地到星体运行、从电磁场到时空弯曲的无边现象。

1953 年,爱因斯坦在答复一位科学爱好者"科学是什么"的提问时总结道:西方科学的发展基于两大成就——“希腊哲学家发明的形式逻辑体系(在欧几里得几何学中),以及(文艺复兴时期)发现的通过系统的实验找出因果关系的可能性”〔21〕。这段话精确刻画了本文所称的确定性思维传统:相信世界存在不以人的意志为转移的客观规律,且可以为人类所认知;其基本方法是观察现象、提出假设、通过逻辑推理做出预测,再以可重复的实验加以验证——逻辑推理保真,实验独立复核,原理因此确立。而在这一传统中,数学被奉为表达确定性的最高手段:它独立于具体的表达者,任何人只要掌握了它的语言,对于同一个确定性都能达到同样的认知。我们甚至可以说,数学是物理学的"最高境界”——它是人类对世界的确定性把握所能找到的最有效的表达。

然而,历史在此处埋下了反讽的引线。二十世纪初,正是这一信念最坚定的捍卫者们,亲手触碰到了它的边界。

2.3 形式化之梦与计算的内在限界

2.3.1 希尔伯特之梦

1900 年,巴黎国际数学家大会。希尔伯特(D. Hilbert)提出著名的二十三个问题,其中第二问题(算术公理的相容性)与第十问题(丢番图方程可解性的机械判定)直指数学确定性的根基:数学系统是否完备?数学定理的真伪是否可以由机械程序一劳永逸地判定?〔22〕在希尔伯特看来,答案必须是肯定的。1930 年,他在柯尼斯堡的演讲中留下了那句后来刻上墓碑的誓言:“我们必须知道,我们必将知道。"(Wir müssen wissen — wir werden wissen.)〔23〕

这一纲领的潜台词是彻底的:如果数学可以被完备地公理化,那么"证明"就将蜕变为对符号串的机械操作——数学成为一台自动运转的语言机器,数学家之"思"在原则上可以被取代。莱布尼茨的演算之梦、弗雷格的概念文字、罗素的逻辑主义、希尔伯特的形式主义,汇聚成同一个梦想:把知识完全沉淀为自洽的、可机械检验的符号系统。

形式化之梦:从莱布尼茨到希尔伯特

2.3.2 哥德尔与图灵:限界的两次数学证明

梦想破碎的方式,是数学史上最优雅的悲剧。

1931 年,哥德尔(K. Gödel)发表《论〈数学原理〉及有关系统中形式不可判定的命题》,证明了两个不完备定理:第一,任何足够强(包含初等算术)且一致的形式系统,必存在既不能被证明也不能被否证的命题——符号系统不可完备;第二,这样的系统无法在其内部证明自身的一致性——符号系统不能自我担保〔24〕。哥德尔所用的对角线方法,本质上是让形式系统谈论自身——当"名"试图穷尽地指称"名"自身时,循环便产生了无法消除的裂缝。

1936 年,图灵(A. Turing)与丘奇(A. Church)分别从不同的路径抵达了第二个限界。图灵构造了那台著名的思想机器——一条纸带、一个读写头、一组状态规则——并证明:不存在一个通用程序,能够判定任意程序在任意输入上是否停机〔25〕。希尔伯特所期待的"机械判定一切数学真理"的程序,被证明在逻辑上不可能存在。更具历史反讽意味的是,图灵机本来是为对可判定性问题作出否定回答而设计的思想装置——为摧毁梦想而生的机器,却反而给出了表达确定性计算的最强设计思想,成了计算机时代的出生证:今天所谓"软件定义一切”,其思想源头正是这台纸带机器。

随后形成的"图灵-丘奇论题"为这场溃败划出了最终的疆界:凡是能一步一步说清楚、能机械执行的过程,都是图灵机可模拟的;而且这种模拟在多项式资源消耗的意义上是等价的〔26〕。这既是计算机科学的第一原理,也是一道哲学封印——它把"可说的"与"可算的"焊接为一体,同时也把"说不清楚的"永久地放逐到了机器之外。

2.3.3 双重的溃败:数学与物理的同步触礁

值得强调的是这场溃败的历史同步性:数学的确定性信仰在二十世纪初遭遇哥德尔与图灵的同时,物理学的确定性信仰也正笼罩在"两朵乌云"之下——开尔文 1900 年演讲中提及的两朵乌云,最终分别降下了相对论与量子力学的暴雨;而海森堡不确定性原理更进一步表明,观测者与被观测系统的纠缠,使"完全客观的测量"在原则上成为问题。物理的确定性、数学的确定性、语言的确定性——三条防线在同一代人手中相继告急。

于是,问题被无可回避地推向了哲学:如果数学不能为世界提供终极担保,那么语言呢?符号与实在的关系究竟是什么?二十世纪初的哲学家们给出了两种针锋相对、却都影响深远的回答——它们恰好分别成为日后人工智能两大技术路线的哲学基底。而在中国哲学的深处,同样的问题早已以"名"与"实"的名义被追问了二千余年。这是下一章的主题。

第三章 “名"与"实"的形而上辩难:东西方哲学对照

第二章的结尾留下了一个问题:当数学的确定性被哥德尔与图灵从内部击破之后,语言——那个比数学更古老、更根本的符号系统——与世界的关系究竟如何?这个问题并非二十世纪的专利。在西方,它在柏拉图笔下第一次获得系统的辩论;在中国,它以"名"与"实"的名义贯穿了从先秦到宋明的整部思想史。本章将让两条传统在同一问题压力下相遇——以"符号—意识—世界"的三角形为共同的坐标系。

3.1 西方:从名称的本性问题到语言游戏

3.1.1 克拉底鲁之问:名出于自然,还是出于约定?

柏拉图《克拉底鲁篇》是西方第一部集中讨论"名实关系"的著作〔27〕。对话中,赫谟根尼主张名称纯粹出于约定俗成——名称与事物之间没有必然联系,换个叫法,事物依然如故;克拉底鲁则坚持名称出于自然——每个名称都以某种方式"模仿"了事物的本性,叫对了就是揭示了实在,叫错了便一无所指。苏格拉底在两者之间往返辩难,最终没有给出干净的结论,却第一次把问题本身钉在了西方哲学的墙上:语言对世界的指称,究竟有多大的必然性?

亚里士多德在《解释篇》开篇给出了一个影响后世两千年的折中图式:“口语是心灵经验的符号,文字是口语的符号”〔28〕。语词 → 心灵 → 事物,三级传递——语词不直接触及世界,它经由思想的中介。这个图式的深刻与隐患同样明显:它解释了语言的意义来源,却在"名"与"实"之间插入了一道永恒的间隙。中世纪的唯名论与唯实论之争——共相究竟实在存在,还是仅仅是名称(nomina)——正是这道间隙内部的地壳运动〔29〕。

两千年后,皮尔士(C. S. Peirce)的三元符号学为这道间隙提供了最富生产力的分析框架:符号(sign)之有意义,不在它与对象的二元对应,而在”符号—解释项—对象“的三元关系中——解释项是符号在解释者心灵中唤起的新符号,意义由此成为一个永不停息的三元生成过程〔13〕。这实质上已经把"意识"确立为符号学的独立一极:没有解释者,符号与对象之间只是两条死线段。皮尔士进而按符号与对象的关联方式把符号分为三类:图像(icon,以结构相似关联,如地图与疆域)、指示(index,以因果关联,如烟之于火、温度计之于体温)、规约(symbol,以社会约定关联,如语词)〔13〕。这一分类与本文 1.4.2 的符号三分法精确相映:卦象近于 icon,传感器信号与物理反馈近于 index,语言与数学记号则是 symbol 的典型。后文将反复启用这组对应——尤其在第五章讨论"世界模型"与"符号接地"之时。

这道间隙,就是日后人工智能全部哲学困难的史前形态:机器操作的符号,究竟停留在间隙的哪一侧?它触及过"实"吗?又唤起过"心"吗?

3.1.2 图像论:符号主义的哲学基底

二十世纪哲学对这个问题最激进的回答,来自年轻的维特根斯坦。《逻辑哲学论》(1921/1922)试图一劳永逸地填平那道间隙:“命题是实在的图像”(4.01)——语言之所以能够言说世界,是因为命题与它所描述的事实共享同一种逻辑形式;语言与世界之间不是任意的约定关系,而是结构上的同构关系,如同乐谱与乐曲、地图与疆域〔30〕。由此得出的结论斩钉截铁:“我的语言的界限意味着我的世界的界限”(5.6);凡是可以说的,都可以说清楚;而对于不可说的——伦理、价值、世界的整体意义——“必须保持沉默”(命题 7)〔30〕。

我们可以把这一思想概括为"语言即世界”:语言所能表达的才是有意义的,语言的边界就是世界的边界。值得注意的是,图像论在三角形中的位置极其特殊:它试图把"意识"一极化约为无形的镜子——心灵只是反映同构关系的透明中介,本身不值得谈论(这正属于命题 7 所宣告的沉默领域)。它在哲学上的命运多舛,却在工程学上获得了意想不到的长寿:符号主义人工智能的全部纲领——用显式的符号表征世界知识,用逻辑规则操纵这些符号——恰恰是图像论的技术翻译。知识与事实同构,推理与计算同构,机器因此可以仅凭符号操作复演世界。第四章将看到,这一纲领何其辉煌,又何其脆弱。

3.1.3 语言游戏:连接主义的哲学预言

晚年的维特根斯坦亲手拆毁了早年的大厦。《哲学研究》(1953,身后出版)开篇便自我清算:语言根本不是一幅幅描画世界的图像,而是形形色色的"语言游戏”——命令、提问、玩笑、祈祷、计算、讲故事,每种用法都服从不同的规则;“一个词的意义就是它在语言中的使用”(§43)〔31〕。意义不在符号与世界的静态对应里,而在动态的生活实践中;语词家族之间没有共同的本质,只有"家族相似"(§67);甚至不存在仅供自己理解的"私人语言"——意义本质上是公共的、社会的〔31〕。

这场"转向"对人工智能的意义,直到七十年后才完全显现。大语言模型的工作原理——从海量语料中学习词与词在使用中的统计关联,让意义从高维向量空间的结构中自行涌现——几乎是"意义即使用"的机器实现:机器从未见过世界,只见过语言的使用,却在词元的分布中学到了关于世界的大量知识。后期维特根斯坦无意中为连接主义写下了一份超前的哲学许可证。

但也正是在这里,怀疑论的声音同样来自维特根斯坦式的直觉:只见过"使用"、从未接触过"世界"的机器,所获得的究竟是意义本身,还是意义的影子?这正是塞尔的"中文房间"(第四章)与当下"LLM 是否理解"之争的核心。而中国哲学对这一问题的思考,早已准备了另一套概念工具。

3.2 中国:正名、名实、言意与知行合一

3.2.1 先秦之一:孔子正名——名的伦理维度

“名"的问题在中国一登场,就带着与西方不同的温度。《论语·子路》记载孔子之言:“名不正,则言不顺;言不顺,则事不成”〔32〕。正名首先不是逻辑问题,而是伦理-政治问题:名分错乱,则行为失据、秩序崩坏。值得注意的是,这一看似与形而上学无关的进路,已经隐含了一个深刻洞见——名不是对实的被动描画,而是对实的主动构造:社会实在本身就是由名分构成的。这与后期维特根斯坦"语言游戏"植根于"生活形式"的见解,遥隔两千年而暗通。

3.2.2 先秦之二:名家与庄子——符号的自我循环及其超越

真正把名实关系推到逻辑极限的,是名家。公孙龙的《白马论》以"白马非马"的著名命题,分析了名与名之间的不可通约:“马"指形,“白"指色,“白马"是色与形的复合,故不等于"马”〔33〕。《指物论》则提出了更抽象的论断:“物莫非指,而指非指”——万物无不通过指称(名)而被把握,但指称本身并不是被指称的东西〔33〕。“指"不是"物”:符号系统是一个自足的领域,它与实在的关系是"指涉"而非"同一”。

庄子敏锐地抓住了名家暴露的裂缝,并将其转化为一种更高的智慧。《齐物论》写道:“以指喻指之非指,不若以非指喻指之非指也;以马喻马之非马,不若以非马喻马之非马也。天地一指也,万物一马也”〔34〕。这段话常被读作诡辩,其实是一次深刻的范式跃迁:庄子承认名家的分析——在符号系统内部打转,“以指喻指”,永远只能得到符号;但他的结论不是修补这个系统,而是跳出它——从"天地"的尺度看,指与非指、马与非马的分别本身即是人为的投影。名的世界是自指的循环,而"道枢"在循环之外。

需要说明的是学术上的谨慎:“以指喻指"“天地一指"出自《齐物论》,但"指"的概念装置本于公孙龙《指物论》,庄子是化用名家而超越名家——这层互文关系,恰是先秦思想"百家争鸣、相互激发"的生动例证〔35〕。

3.2.3 先秦之三:荀子——约定俗成的社会契约

荀子《正名》篇给出了先秦名学最成熟的形态:“名无固宜,约之以命。约定俗成谓之宜,异于约则谓之不宜”〔36〕。名称没有天然固有的恰当性,意义来自共同体的约定与历史的使用——这与《克拉底鲁篇》中赫谟根尼的立场相似,但荀子比赫谟根尼走得更远:他不仅指出名的约定性,还分析了制名的目的(“明贵贱、辨同异”)与名的系统性(共名与别名的层级)。在人工智能时代重读荀子,会惊觉其现代性:“约定俗成"正是"意义即使用"的古典版本——而大语言模型所学习的,正是人类语言共同体的"约定俗成"在文本中的沉积。

3.2.4 言意之辨与道禅:名的边界与缄默的智慧

如果说先秦诸子在名的内部做文章,那么另一条传统则始终凝视着名的边界。《道德经》开篇即划界:“道可道,非常道;名可名,非常名”〔37〕——凡可以被言说的道,已不是那恒常的道;凡可以被命名的名,已不是那终极的实。《易传·系辞上》借孔子之口感叹:“书不尽言,言不尽意”〔38〕。魏晋时期,这一感叹发展为系统的"言意之辨”:王弼在《周易略例·明象》中给出了著名的三级结构——“言者所以明象,得象而忘言;象者所以存意,得意而忘象”〔39〕。言是工具,象是中介,意是目的;工具的价值在于被超越,执着于符号本身,恰恰丢失了符号所要传达的东西。

禅宗将这一智慧推向极致:“教外别传,不立文字,直指人心,见性成佛”;而《楞严经》的"指月"之喻——“如人以手指月示人,彼人因指,当应看月”——则为整个传统提供了最凝练的图像〔40〕。名如手指,实如明月;认指为月,双失月与指。

指月之喻

此刻值得暂停片刻,回望人工智能:大语言模型的全部知识来自"手指”——文本是人类指向世界的手指留下的记录。机器从未抬头看月。中国哲学的诊断因此直截了当:LLM 所患的,是"认指为月"之病;治疗的方案,也不言自明——让机器的手指真正指向并触碰世界。这正是第五章"世界模型"与"具身智能"的哲学先声。

3.2.5 知行合一与心外无物:意义在实践与心中的完成

中国哲学对名实问题的最终回答,落在"行"与"心"上。

先看"行”。王阳明针锋相对于程朱的"知先行后”,提出"知行合一”:“知是行之始,行是知之成”〔41〕——知与行不是两件事的先后,而是一件事的两面;不能行,即是不真知。他进而强调:“人须在事上磨练,做功夫,乃有益”〔41〕。真知必在具体的、身体的、与世界的碰撞中完成;离开"事上磨练"的"知",只是"悬空去思索"的妄想。

再看"心"。心学对"意识—世界"这条边的回答同样彻底。王阳明断言"心即理"——天理不在心外,心与物本不相离。《传习录》所载看花公案最为著名:友人问,天下无心外之物,如此花树在深山中自开自落,与心何干?先生答:“你未看此花时,此花与汝心同归于寂;你来看此花时,则此花颜色一时明白起来。便知此花不在你的心外”〔41〕。这并不是说心灵凭空造出物质,而是说:世界之"呈现",总已是意识中的呈现——实在从未以未经意识中介的方式到达我们。这一立场与 3.3 所述"天人合一"的符号论重述一脉相通,并与第六章"提问即测量"(观察即介入)的当代隐喻遥相呼应。

将这一思想转译为人工智能的语言:一个系统唯有通过行动-反馈的闭环介入世界,其符号表征才可能获得超出符号相互定义的意义。王阳明的"知行合一",为具身智能提供了五百年前的哲学奠基——这一对应将在第五章展开为完整论证。

3.2.6 唯识宗:万法唯识与意识的构造论

若说心学给出了"意识—世界"关系的伦理化表述,那么源自印度瑜伽行派、由玄奘师徒在中国发扬的唯识宗,则给出了整个中国哲学中最系统的意识构造论。其核心命题"万法唯识"主张:人所经验的一切现象,皆非离识独存的外境,而是识的变现。为此它建立了一套精致的"八识"模型:眼、耳、鼻、舌、身五识司感知,第六识(意识)司分别思维,第七识(末那识)恒审思量、执持自我,而最深的第八识——阿赖耶识(藏识)——含藏一切经验"种子";种子遇缘"现行"为现象世界,现行又反过来"熏习"新的种子,构成一个自我更新的表征循环〔42〕。

以当代眼光重读,阿赖耶识的结构令人惊叹地接近一个"世界模型":它是储存经验、生成表象、并在新经验中持续更新的内在表征库;“种子—现行—熏习"的循环,简直就是一个带反馈回路的生成模型。当然,类比的边界必须声明:唯识宗的宗旨是解脱论而非认知科学,其"识"含摄情感、业力与转依解脱的维度,远非计算表征所能穷尽。但这一对照至少说明:“我们所经验的世界是内部表征的建构物"这一命题,并非认知科学的专利——早在一千五百余年前,中国哲学就以另一套语言系统地思考过它。本文第五章称世界模型为"机器时代的象”,其最古老的东方回声,正在此处。

“言—象—意"三级结构与阿赖耶识的"种子—现行"循环

3.3 立象尽意:阴阳五行、太极八卦与中国传统的"象"符号体系

前面诸子多从"名"的内部或边界立论,而《易传》传统给出了另一条进路:面对"言不尽意"的困境,中国哲学的回答不是堆积更多的言,而是升维的符号。《系辞上》那段著名问答其实还有下半句:“然则圣人之意,其不可见乎?子曰:圣人立象以尽意,设卦以尽情伪,系辞焉以尽其言”〔38〕。“象"由此成为一种自觉的符号类型——“易者,象也;象也者,像也”——它不指称世界,而以自身的结构变换模拟世界的运行,意义在模型的推演中显现。

以本文 1.4.2 的符号三分法观之,中国传统发展出了高度成熟的关系性符号模型性符号,它们与西方以指称为中心的符号观形成结构性对照:

  • 太极八卦:模型性符号的古代典范。 阴爻与阳爻三重组合成八卦、六重组合成六十四卦——这本质上是一套 3 比特与 6 比特的组合编码,以爻变、卦变为变换规则。卦不"指称"某一具体之物,而以自身结构模拟一类情势及其演化方向;问《易》者所得的,不是一个名称,而是一个可推演、可对照处境的模型。以皮尔士的术语说,卦象是典型的 icon——以结构相似而非因果或约定来表意。
  • 阴阳五行:关系性符号的典型。 五行的意义不在每个元素指称何物,而在相生相克的关系结构之中——木、火、土、金、水构成一个有向循环图,每个"名"完全由它在图中的位置与变换规则(生、克、乘、侮)来定义。这是一种纯粹的关系语义学:意义生于系统内部的差异与变换,而非对外部实在的指称——它与索绪尔结构主义的"意义生于差异”、乃至 LLM 词元向量的分布语义,在结构上是同构的。可以说,五行是中国古人手工打造的低维"嵌入空间”。
  • 天干地支:循环坐标代数。 十干与十二支以模 10、模 12 配合,最小公倍数构成六十甲子的循环,为时间、方位提供可计算的索引。它表明中国传统同样拥有抽象的"计算"冲动——只是这种计算服务于历法与类推,而非公理演绎。

这套"象"符号体系经由"取象比类"的类比映射,广泛应用于中医与术数:中医以五行建脏腑之模、以生克释病机传变,诊疗在"干预—反馈"的临床闭环中不断校准——符号系统与身体、四时始终保持耦合,所谓"天人合一”,在符号论的层面上正可以重述为:符号系统与世界(及人自身)不被视为可分离的两端。李约瑟(J. Needham)曾将这种思维命名为"关联式思维"(correlative thinking),以别于西方主导的因果-形式思维〔43〕;葛瑞汉(A. C. Graham)亦有专书阐发〔44〕。本文第五、六章将分别回到这一体系的两端应用:它如何预示了"世界模型"的结构与判据(第五章 5.1.2),以及"起卦—断卦"如何构成一种"人在回路"的符号技术(第六章 6.3)。

最后是一个不可不提的历史回声。1703 年,二进制算术的发明者莱布尼茨在《二进制算术解说》中明确写道,他从传教士白晋寄来的伏羲六十四卦图中,看到了二进制记数法的古老先例(详见 2.1.1)〔16〕。中国的"象"符号与西方的形式语言,在三百年前的这次照面,是两种符号传统最早的交汇点之一:一边把卦看作宇宙情势的模型,一边把卦看作 0 与 1 的排列——同一幅图,两种读法,各自通向了宏大的思想体系。

3.4 枢纽:图灵-丘奇论题与"道可道,非常道"

两条传统至此可以正式相遇。让我们把两个命题并置:

  • 图灵-丘奇论题:凡是能一步一步说清楚、能机械执行的,都是图灵机可模拟的〔25-26〕。
  • 《道德经》第一章:道可道,非常道;名可名,非常名〔37〕。

二者的焊接点可以一语道破:可计算性的疆域,恰好以"可说清楚"为界;而老子那不可常道、不可常名的"道",恰恰落在这片疆域之外。这句看似轻巧的对照,实则揭示了一个深刻的结构同构:

西方传统用数学证明边界——哥德尔不完备定理与停机问题从内部证明:足够强的符号系统必然存在它自己无法触及的真理。中国传统用直觉体认边界——“言不尽意"“道不可道"从外部断言:终极之实永远溢出一切名之网罗。一边是形式系统的自我指涉产生裂缝,一边是命名行为的自我指涉产生悖论;一边是"系统内不可证”,一边是"可名者非常名”。两种文明在两千年的隔绝中,抵达了同一条海岸线。

同一条海岸线:东西方名实之辨的双轨进路

这个同构对人工智能的判据意义是直接的:机器是图灵机的造物,它的疆域在原则上被"可说的"所限定——这解释了符号主义的边界(第四章),也定义了任何"超越纯符号"的技术路线所必须回答的问题:机器能否以某种方式,触及"可道"之外的"实"?世界模型与具身智能之所以重要,正因为它们是人类为机器寻找"手指之外的月亮"的当代尝试(第五章);而量子意识假说之所以诱人,正因为它暗示人脑可能天然地栖居在这条海岸线之外(第六章)。

名实之辨,由此不再是古籍中的形而上学,而成为评估人工智能现状与未来的活的坐标系。

第四章 人工智能发展史的哲学范式重构:映射、仿真与交互

前两章铺设了两条轨道:一条是数学与形式化的确定性传统及其限界,一条是名与实的东西方哲学坐标系。本章让人工智能七十年的技术史驶入这两条轨道。我们将看到,AI 史的每一次范式更替,都不是单纯的工程事件,而是"名"逼近"实"的方式的更替;每一次危机,都精确地落在哲学早已标出的暗礁上。全章以引言提出的三阶段框架组织:映射(符号主义)、仿真(连接主义与大语言模型)、交互(控制论先声与具身转向的思想准备)。

人工智能史的三范式:映射、仿真与交互

4.1 映射:符号主义的荣光与陨落

4.1.1 从图灵机到达特茅斯:确定性之梦的技术化身

人工智能学科的合法性问题,直接继承自图灵机。这条思想链可以梳理如下:图灵机证明了"编码变换"可以独立于编码者而自主执行——程序一旦写成,人便可以离开系统,机器确定性地完成计算;于是"软件定义一切"成为可能,而一个自然的想象随之而来:这个能够模拟人类计算活动的装置,能否模拟人类智能本身?1950 年,图灵在《计算机器与智能》中以"模仿游戏"为智能给出了一个可操作的行为主义判据〔2〕;1956 年夏,麦卡锡、明斯基、香农、罗切斯特等人在达特茅斯学院发起研讨会,“人工智能”(Artificial Intelligence)正式命名,其工作假设自信而明确:“学习的每一个方面、智能的每一个特征,原则上都可以被精确描述,从而可以造出模拟它的机器”〔45〕。

这一假设正是早期维特根斯坦图像论的工程版本:智能 = 对世界知识的显式表征(名)+ 对表征的逻辑操纵(推理)。早期成果似乎验证了这条路线:纽厄尔与西蒙的"逻辑理论家"(1956)证明了《数学原理》中的多条定理;通用问题求解器(GPS)、SHRDLU 积木世界相继问世〔46〕。

4.1.2 专家系统的巅峰与两次寒冬

1970–80 年代,符号主义以"专家系统"的形态迎来产业高光:DENDRAL 从质谱数据推断分子结构,MYCIN 为血液感染开具处方,XCON 为计算机配置订单——知识的工程化(knowledge engineering)一度被视为 AI 的正统形态〔47〕。日本 1982 年启动的"第五代计算机"计划,更将符号推理推向了国家工程的高度〔48〕。

然而寒冬两度降临。第一次(1970 年代):1966 年 ALPAC 报告宣告机器翻译未达预期,1973 年英国 Lighthill 报告尖锐批评 AI 未能兑现承诺,资助大幅收缩;明斯基与帕珀特《感知机》(1969)对单层神经网络的数学否定,则几乎冻结了连接主义路线十余年〔49〕。第二次(1980 年代末至 90 年代初):专家系统的知识获取瓶颈与维护成本暴露无遗,Lisp 机市场崩溃,五代机计划 1992 年悄然落幕〔48〕。

在本文的框架中,两次寒冬不是偶然的投资周期,而是确定性思维局限的历史显影:符号主义预设了世界可以被完备地显式编码——而哥德尔早已证明,足够强的符号系统不可完备;常识的汪洋大海(框架问题〔50〕:机器如何知道哪些事情不会因一个动作而改变?)则证明,“说清楚"这三个字的代价,远比达特茅斯的先驱们想象的昂贵。

4.1.3 哲学诊断:中文房间、符号接地与意向性

符号主义的深层困难,被两个哲学论证精准命中。其一,塞尔的"中文房间”(1980):一个不懂中文的人身处房间,按英文规则手册熟练地操作中文符号,对外表现出完美的中文对话能力——但房间里没有任何东西"理解"中文。句法操作不构成语义,程序的形式完美不等于心灵的在场〔4〕。其二,哈纳德的"符号接地问题"(1990):符号的意义若只来自符号之间的相互定义,就如同一本给不懂语言者使用的"中文-中文词典"——每个词条都用同样陌生的符号解释,永无出路;符号必须在非符号的经验(感知、行动)中接地,意义才可能发生〔5〕。

这两个论证的共同靶心,可以用一个概念点名——意向性(intentionality)。布伦塔诺 1874 年称之为"心灵的标记":意识在本质上总是"关于"某物的意识——相信什么、渴望什么、看见什么;而纯符号操作不具备这种原生的关于性,机器符号的"所指"是派生的——由设计者、使用者与解释者从外部借予〔14〕〔51〕。在"符号—意识—世界"的三角形中,这是"符号—意识"之边在本文的首次登场:中文房间否决了"句法自足地产生意向性",符号接地问题则指出了通往"世界"一极的缺口。后续章节将看到,大语言模型把这场争论以更大规模重新点燃,而具身智能与世界模型,正是工程界对这两条边的回应。

用中国哲学术语重述:符号主义的全部工作都在"名"的系统内部展开,它造出了越来越精巧的"指",却从未让"指"触及"物"。这正是《指物论》“物莫非指,而指非指"的机器版困境。

4.2 仿真:连接主义与大语言模型

4.2.1 从神经元到深度网络:统计路线的回归

与符号主义几乎同龄的另一条路线,走的是相反的方向:不编码规则,而让机器从数据中自己长出规则。1943 年麦卡洛克与皮茨的人工神经元模型、1957 年罗森布拉特的感知机,是这条路线的雏形〔52〕;经历《感知机》一书的冰封与 1986 年反向传播算法的复兴〔53〕,它终于在算力与数据的汇合处爆发:2012 年,AlexNet 以深度卷积网络横扫 ImageNet 竞赛,深度学习时代开启;2017 年,Transformer 架构以"注意力"机制统一了序列建模;2018 年后,GPT 系列沿着规模定律(scaling laws)一路推高参数量与语料量,2022 年末 ChatGPT 问世,机器的语言能力第一次让全社会惊觉〔54〕。

4.2.2 向量空间中的"万物皆数”:仿真的哲学结构

大语言模型的哲学结构值得细看。机器对每个词元的全部"认识",是它在数万亿次语言使用中与其他词元共现的统计模式;训练目标朴素至极——预测下一个词。然而香农早在 1948–1951 年的信息论奠基工作中就已指明:预测与压缩是同一件事的两面——能更好地预测下一个符号,就是更好地压缩了序列的信息,也就是更深地抓住了序列背后的结构〔55〕。语言是人类对世界经验的有损压缩,而预测语言,就是对这份压缩档案的再压缩。由此观之,LLM 在高维向量空间中重建的"世界知识",是毕达哥拉斯"万物皆数"的当代形态:数不再被当作世界的本质比例,而被当作世界在语言中的投影的坐标。

这正是后期维特根斯坦"意义即使用"的机器实现(见 3.1.3):机器从未接触"实",却在"名"的使用模式中涌现出对"实"的惊人推断力——它能写出流体方程的解析延拓,能发现数学家未曾走过的证明路径。纳维-斯托克斯难题的攻克表明,这种"仿真"的纵深,远远超出了怀疑论者几年前的想象〔1〕。

4.2.3 瓶颈诊断:离岸计算、幻觉与莫拉维克悖论

但瓶颈同样清晰,且同样具有哲学结构。

其一,幻觉。LLM 的输出在统计上合理即可生成,与事实是否相符并无内在担保——“知而不行”,则"知"无锚点。其深层原因不在工程而在范式:模型的全部世界就是文本,而文本可以为假。

其二,莫拉维克悖论。机器人学家莫拉维克在 1988 年指出:让机器在棋类、定理证明上达到成人水平相对容易,让它在感知与运动上达到一岁儿童水平却极为困难〔8〕。演化用数亿年打磨的"低级"能力(视觉、行走、抓取),是无意识的、不可言传的、身体化的——恰是符号化最难触及的部分;而人类引以为豪的"高级"推理,反倒是演化史上最新、最表层、最容易形式化的能力。悖论因此是具身性的反证:人类智能的根基不在可说的推理,而在不可说的身体技能——这与第三章"言不尽意"的诊断完全同构。

其三,“离岸计算”(本文提出的概念):LLM 的全部"存在"都悬浮于物理世界之外——它没有质量、温度与位置,不承受行动的代价,其"意义"如同离岸金融系统中的资本,在符号账户间高速流转而从不落地为实体资产。Bender 与 Koller 的"章鱼思想实验"(2020)对此给出了思想实验版的论证:一条只窃听人类对话、从未见过世界的章鱼,无论学会多么流畅的对话,也无法真正理解"椰子"或"疼痛"——意义无法仅从形式中攀爬抵达〔12〕。

4.2.4 算法四性的瓦解:一个来自计算科学内部的诊断

从计算科学内部,还可以给出一个互补的诊断。经典意义上的"算法"有四性:有限性(问题被有限地表达)、确定性(执行过程确定)、唯一性(给定输入必有唯一确定的输出)、终止性(必然停机并给出结果)。然而今天主导数字生活的推荐系统,已经不是这种经典意义上的算法:用户的特征没有被一个有限的表达在系统中刻画,而是在与人的持续交互中不断积累;系统持续演化、没有唯一答案、也永不停机。换言之,“设计好以后人就可以离开"的时代结束了——人仍在系统之中,在与系统交互的过程中完成系统对人的服务。算法四性的瓦解,标志着一个更深的迁移:机器计算的范式本身,正从"确定性算法"迁移为"不确定性过程”。大语言模型作为持续跟随人类行为而演进的系统,把这一迁移推到了极致。这为第六章"人在系统内"的范式讨论埋下了伏笔。

4.3 交互的先声:控制论与现象学批判

在映射与仿真两大主流之外,还存在着一条时隐时现、如今却愈发关键的第三条线索。

4.3.1 维纳控制论:反馈与被遗忘的路线

1948 年,维纳(N. Wiener)出版《控制论:或关于在动物和机器中控制和通信的科学》,把反馈闭环置于智能研究的中心:智能体的本质不是内部表征的精密,而是"感知—行动—反馈—修正"循环的稳健〔56〕。控制论与早期 AI 同源而异趣:达特茅斯路线将智能定位于符号推理,控制论路线将智能定位于与环境的耦合。历史选择了前者为主流,但反馈思想从未消失——它在强化学习的奖励回路中、在机器人的伺服控制中默默延续,等待重新被记起的一天。

4.3.2 德雷福斯:现象学的预言式批判

哲学家德雷福斯自 1960 年代起对符号 AI 发起了持续半个世纪的批判。基于海德格尔的"在世存在"与梅洛-庞蒂的身体现象学,他论证:人类智能的核心不是显式规则的遵循,而是身体的、情境的、不可言传的技能——熟练的棋手不"计算",他"看到"局势;骑车的人不知道平衡的公式,但身体会〔6〕。德雷福斯在 AI 最自信的年代被斥为门外汉,但两次寒冬、莫拉维克悖论与常识难题的相继爆发,逐条兑现了他的预言。布鲁克斯 1991 年的论文《无表征的智能》——主张抛弃中央表征、让智能从简单的感知-行动层级中涌现——则把现象学的批判转化为机器人学的工程纲领〔57〕。

这条线索在本文框架中的位置因此清晰:控制论与现象学共同预演了"交互"范式——智能不是对世界的映射,也不是对语言的仿真,而是在与世界的交互中生成的能力。它等待的,只是数据、算力与传感技术的成熟。这一天,正在到来——这是第五章的内容。

第五章 破局之道:从"纯文本语言游戏"走向"世界模型"与"知行合一"

第四章的诊断可以浓缩为一句话:映射路线困于"名"的完备性,仿真路线困于"名"的悬浮性——两者的病根是同一个:符号系统与物理世界之间缺失的通路。本章讨论的两条技术路线——世界模型与具身智能——正是工程共同体为打通这条通路所做的当代努力。而在本文的哲学坐标系中,它们分别对应着两件更古老的事情:为"名"重建"实"的内在表征,以及让"知"在"行"中完成。

5.1 空间智能与世界模型:重建"实"的内在表征

5.1.1 谱系厘清:一个概念,多条路线

“世界模型”(world model)并非一家之言,而是一簇共享同一哲学承诺的技术路线:智能体应当在自身内部构建一个关于外部世界运行方式的可预测模型,并借此进行想象、规划与行动,而无需每一步都真实试错。

  • Ha & Schmidhuber(2018):首次以"世界模型"为名,让智能体用变分自编码器与循环网络学习环境动态的隐空间模型,并在"梦境"(hallucinated rollout)中训练策略——智能体第一次可以"闭着眼睛"练习〔9〕。
  • MuZero(DeepMind, 2019/2020):在不知游戏规则的前提下,仅通过与环境交互学会一个支撑树搜索的动态模型,同时称霸围棋、国际象棋与雅达利游戏——模型的价值不在逼真,而在支撑规划〔58〕。
  • LeCun 的 JEPA 路线(2022 起):LeCun 在立场文件《通往自主机器智能之路》中明确提出:自回归式的下一个词预测是一条歧路,真正的世界模型应当在抽象表征空间(而非像素或词元空间)中预测世界的未来状态——联合嵌入预测架构(JEPA)由此而生〔10〕。
  • 李飞飞的"空间智能"与 World Labs(2024 起):李飞飞在 2024 年 TED 演讲中提出,视觉智能的下一步是"空间智能"——让 AI 理解三维世界的几何、物理与可供性,从"看"走向"做";她联合创立的 World Labs 致力于生成可交互的三维世界模型〔59〕。
  • Sora 之争(2024):OpenAI 发布视频生成模型 Sora 时,技术报告径直以"作为世界模拟器的视频生成模型"为题〔60〕;LeCun 等人则批评像素级的视频预测徒有世界的表象,缺乏对物理因果的真正把握。这场争论的价值在于:它把"什么才算理解世界"这一哲学问题,变成了无法回避的工程判据之争。

谱系虽杂,方向如一:从 2D 文本(乃至像素)的概率预测,走向 3D 物理空间与因果结构的内在仿真。

5.1.2 哲学定位:名与实之间的桥梁

在本文的坐标系中,世界模型的意义可以精确表述为:它是在"名"的系统内部,为"实"重建一个内在对应物的尝试。

纯文本 LLM 的知识结构是"以指喻指"——词元的意义完全由词元间的分布关系定义,系统内部没有任何东西对应"重力"或"碰撞"本身,只有"重力"这个词与其他词的关系。而世界模型试图让系统内部涌现出与物理量、几何关系、因果机制同构的状态变量:当模型隐空间中的某个维度系统地追踪了物体的位置与速度,符号便第一次有了指向实在的内部锚点。用第三章的语言说:世界模型是在机器的"言"之中植入"象"的努力——王弼的三级结构"言→象→意"提示我们,从符号到意义之间本来就需要一个中介层次;世界模型,就是机器时代的"象"。无独有偶,早在一千五百余年前,唯识宗就提出过结构相似的构想:阿赖耶识含藏经验种子、现行生成世界(见 3.2.6)——“我们所经验的世界是内部表征的建构物”,从来不是认知科学的专利。

还可以为这座桥梁装上一架精确的标尺——珀尔(J. Pearl)的因果三阶梯:第一层是关联(seeing),第二层是干预(doing),第三层是反事实与想象(imagining)〔61〕。以此衡量,三条路线的位置一目了然:纯文本 LLM 停留在关联层——它是"取象比类"的机器化极致,从共现模式中榨取世界的投影;具身智能登上干预层——表征必须在行动的反馈中接受检验;而世界模型的"梦境推演"则指向想象层——在内部预演未曾发生的未来。第三章所论中国传统的象符号体系(见 3.3),在此提供了一个古老而精确的对照:五行生克之于中医,正是一个低维的、手工打造的、以实践有效性为判据的"世界模型";它的局限在于关联有余而因果不明,而当代 AI 世界模型的雄心,恰是以可计算的方式重建从关联到因果的完整阶梯。

珀尔的因果三阶梯与三条技术路线的位置

5.2 具身智能与"知行合一"的闭环

5.2.1 技术形态:从感知-行动闭环到通用机器人

如果说世界模型是向内重建"实",具身智能(Embodied AI)则是向外接入"实"。其技术闭环为:传感器(视觉、触觉、力觉)采集物理状态 → 策略模型决策 → 执行器作用于环境 → 环境反馈新的状态。近年来,这一闭环与 LLM 的多模态能力加速合流:Google DeepMind 的 RT-2(2023)将视觉-语言模型直接接入机器人动作空间;Physical Intelligence 的 π0(2024)以"机器人基础模型"为纲领,用海量操作数据训练通用的抓取与操作技能〔62〕。仿真到现实(sim-to-real)的迁移、世界模型作为机器人的"内感官"(在想象中预演动作后果),则把 5.1 与 5.2 两条路线缝合为一。

5.2.2 与王阳明互释:事上磨练的机器版

王阳明的"知行合一"为具身智能提供了一套现成的解释框架,而具身智能则反过来为"知行合一"提供了一个前所未有的精确注脚。

  • “知是行之始,行是知之成”〔41〕:在具身系统中,“知”(策略表征)与"行"(动作执行)确实是一件事的两面——表征在动作反馈中被塑形,动作在表征引导下被生成;没有"行"的"知"无法更新,没有"知"的"行"只是随机探索。
  • “人须在事上磨练,做功夫,乃有益”〔41〕:机器人学中最朴素的经验正是如此——仿真中学到的抓取策略,必须在真实物体的摩擦、重量、形变中反复碰撞修正,才能成为可用的技能。物理世界以其不可化约的阻力(摩擦、惯性、不确定性),充当着最严格的老师:唯有它,从不接受统计上"差不多"的答案。
  • “知而不行,只是未知”〔41〕:这是对 LLM 幻觉问题最凝练的哲学诊断——文本之"知"因无"行"之校验,故不成为真知;幻觉不是 bug,而是"悬空去思索"的必然症状。

由此,本文对符号接地问题给出一个审慎的表述:物理反馈是符号接地的关键路径(而非充要条件)。其所以审慎,是因为学界对"纯语言能否获得部分意义"仍有真实的分歧——Bender 与 Koller 的章鱼实验说明纯形式无法抵达全部意义,但 LLM 在数学与编程等自指领域的表现又提示,语言内部确实存在某种程度的意义内源〔12〕。“关键路径"的表述既承认了具身反馈的不可替代性(对涉及物理指称的意义而言),又不武断地否定符号系统内部的意义生成空间——这本身就是"容纳不确定性"的一次实践。用皮尔士的术语重述(见 3.1.1):语言与数学是 symbol,机器缺的是 index——符号与世界之间由因果作用直接铸就的关联;而传感器的物理信号与行动的反馈,正是把 index 维度补进机器意义系统的通道。

5.2.3 回应德雷福斯:批判的部分兑现与剩余难题

第四章末尾留下的问题是:具身智能是否兑现了德雷福斯的预言式批判?公允的回答是"部分兑现”。

已兑现者:表征不再是中央显式的,而是从感知-行动的耦合中分布式涌现;技能的学习确实绕过了"规则编码",直取布鲁克斯设想的层级化路线;莫拉维克悖论所指认的"低级能力"的困难性,被机器人学的缓慢进展反复确认。

剩余难题:其一,德雷福斯强调的"身体"不仅是传感器加执行器,而是有需求、有生死、有情绪的内稳态系统——机器没有"在乎"(care),其"实践"是否因此始终缺少存在论的根基?其二,常识的灵活性——在无穷开放的情境中即时调取恰当背景知识的能力——仍是具身系统的短板。这两个难题指向同一个更深的问题,本文将留到第六章处理:智能的最后边界,可能不在工程,而在意识与生命。

值得补充的是,已有研究在尝试用尚未形成语言能力的婴幼儿的感知经验来训练模型——这条绕过语言、直接从感知经验学习的路线,恰好是具身智能在"前语言"维度上的投影,也是机器重走人类个体发生学道路的实验。语言究竟在多大程度上是智能的必要条件,这个古老的哲学问题,正在被做成实验科学。

5.3 哲学综合:三阶段的合题

回顾引言提出的框架,至此可以给出它的完成形态:映射(符号主义)是"名"对"实"的静态描画,败于不完备;仿真(LLM)是"名"在自身内部的统计重构,困于悬浮;交互(世界模型 + 具身智能)则是"名"与"实"的双向奔赴——向内重建"实"的模型(象),向外接受"实"的校验(行)。三阶段构成一个黑格尔意义上的正反合:世界模型保留了映射路线"内部表征"的合理内核,具身闭环吸收了仿真路线"从经验中学习"的合理内核,而二者的合题,指向一种全新的智能形态——它既在语言中思考,也在世界中存在。

这一合题是否足以通向通用人工智能?第六章将讨论它面对的三重追问:算力的、意识的与范式的。

第六章 未来展望:限界、意识与人机共生

第五章的合题——世界模型与具身智能——给出了当前可见的技术路线图。但展望必须比路线图看得更远。本章处理三个层层递进的追问:算力的底座能否升级(量子计算)?智能的顶端是否存在计算原则上无法触及的领域(意识问题)?以及最根本的:人机之间的认知范式正在发生何种转向(从"让人走开"到"人在系统内")?

6.1 算力底座的演进:量子计算的真实承诺与边界

量子计算常被渲染为"突破图灵机"的下一次革命,公众话语中的这一表述必须予以澄清——因为它恰好混淆了第二章所确立的两个层次。

量子计算不改变可计算性的边界。 图灵-丘奇论题所划定的"可计算/不可计算"之界,在量子计算机上原封不动:量子计算机能计算的任何问题,经典图灵机原则上也能计算,反之亦然;停机问题对量子机器同样不可判定〔63〕。量子计算改变的是复杂度的版图:Shor 算法(1994)使大整数分解在量子计算机上获得多项式时间算法,Grover 算法(1996)使无序搜索获得平方加速——某些在经典机器上"实际不可行"的问题,在量子机器上变得可行〔64〕。一言以蔽之:量子计算机仍然运行在确定性计算的疆域之内,它只是为某些指数级复杂性的问题,找到了更快的算法。

对人工智能而言,量子计算的真实承诺因此在两处:其一,量子机器学习——线性代数运算(量子态本身即是高维向量)的潜在加速,可能惠及模型训练与推理的底层;其二,本征的量子表征——第五章谈到"万物皆数"的向量形态,而量子态是比经典向量更丰富的高维对象(叠加、纠缠),以真实量子态承载计算,可能开启今日难以尽言的表征空间。但也必须如实记录不确定性:当前量子硬件仍处于 Preskill 所称的 NISQ(含噪声中等规模量子)时代〔65〕,容错量子计算的时间表仍属未知。量子计算是 AI 算力底座的期权,而非即期支票。

6.2 意识问题:从"困难问题"到彭罗斯的终极质疑

如果说量子计算的量级是"更快",那么"意识"一极提出的问题则是"原则上可能与否"——它直指本文核心命题的边界。先把地形图铺开,再进入最激进的那个质疑。

意识问题的地形图。 查默斯(D. Chalmers)1995 年区分了意识问题的"易"与"难":解释感知、注意、报告与行为控制等功能,原则上属于神经科学与计算可以逐步攻克的"易问题";而解释体验本身——为什么物理信息处理会伴随"成为这个系统是什么样子"的感受性(qualia)——则是"困难问题"〔66〕。当代意识科学的主流理论,如全局工作空间理论(GWT)与整合信息论(IIT),多在"易问题"与神经相关物层面推进,困难问题依然开放〔67〕。本文的立场因此在两处设防(呼应 1.4.2 的术语约定):其一,全文除本节外仅在功能层面使用"智能"与"理解",不主张机器具有现象意识;其二,对任何宣称已"解决"意识问题的技术叙事保持怀疑——大模型行为上的可理解性,不等于体验的在场。正是在这片地形的最边缘,彭罗斯给出了最激进的质疑。

彭罗斯的论证。 彭罗斯(R. Penrose)在《皇帝新脑》(1989)与《心智之影》(1994)中提出的论证,以第二章的哥德尔定理为支点:任何形式系统都有它无法内证的真命题,而人类数学家却能够"看出"这些命题为真(如看出系统的一致性);因此人类的数学洞察不可能本身是某个形式系统的机械输出,人脑必然利用了某种非计算的物理过程〔68〕。彭罗斯与麻醉学家哈梅罗夫(S. Hameroff)进一步给出了候选机制——“协调客观还原”(Orchestrated Objective Reduction, Orch-OR):意识源于神经元微管中量子叠加态的引力诱导坍缩,而这一坍缩过程在原则上是不可计算的〔69〕。

对此,本文持明确的审慎立场,分三层陈述:

其一,哥德尔论证的哲学有效性本身存在争议。逻辑学家自卢卡斯(J. R. Lucas)1961 年首次提出此类论证以来,对其前提的批评从未停止——人类数学家同样可能出错,“看出一致性为真"并非不可错的直觉〔70〕。

其二,Orch-OR 是假说,不是理论。其最著名的定量反驳来自泰格马克(M. Tegmark):他估算脑内生理温度下微管量子态的退相干时间(约 10⁻¹³ 秒)远短于神经动力学的时间尺度(约 10⁻³ 秒),量子效应似乎在来得及影响神经活动之前就已消散〔71〕;彭罗斯与哈梅罗夫此后提出过修正与回应,但远未获得神经科学共同体的接受〔72〕。

其三,必须严格区分两种"量子"话语。彭罗斯的 Orch-OR 是对人脑物理机制的字面物理主张;而近年来流行的另一种用法——把大模型称作"平行世界的叠加态”、把一次提问称作对系统的一次"测量"——则是借用量子概念来组织思考的认识论隐喻:隐喻的价值在于启发,而非断言机器内部存在量子态。两者各擅其场,混用则两败:隐喻被误当理论而遭受科学性质疑,理论被误当隐喻而逃避经验检验。

尽管争议重重,彭罗斯质疑的功能性价值不容低估:它为"人脑是否等于图灵机"这一终极问题,钉下了一根无法被拔掉的路标。只要 AGI 的定义涉及"人类水平的全部认知能力",非计算性假说就是任何未来展望都绕不开的对手——而"困难问题"的存在则提醒我们:即便跨过了计算的边界,意识的门前还有另一道无人持钥匙的门。

6.3 认知范式的转向:从"让人走开"到"人在系统内"

比算力与意识更切近的,是认知范式本身的迁移。本文以三个思想节点刻画这一迁移的完整弧线。

节点一:天启图灵机。 面对不可判定问题的绝境,图灵在其博士论文(1938/1939)中引入"天启机"(oracle machine):机器在证明途中遇到无法逾越的关卡时,可以求问一个全知的"天启"〔73〕。一个犀利的解读是:经典图灵机的要义是"不以人的意志为转移"的确定性——编码完成,人即离场;而天启机把确定性从"不以人的意志为转移"引向了"以某种更高的意志为转移"——可是哪里来的神?没有神,但是有人。“天启”,就是回环中的人(human-in-the-loop)在理论模型中的席位。

节点二:图灵测试的重读。 1950 年图灵把"机器能否思考"交给一个具体的人去判定——这个操作常被当作行为主义的简化,但更深的意味在于:图灵在此有意无意地放下了"不以人的意志为转移"的教条,把智能的判据从客观验证转向了交互中的主体间性〔2〕。一个系统"是否有智能",不再有经典意义下的确定性答案——它取决于参与判定的那个具体的人。智能不再是一个系统"内在地"拥有的属性,而是它在与人打交道中被授予的地位。用本文的三角形说:图灵测试是一场刻意悬置"意识"一极、只在符号层的交互中裁判智能的测试——这正是它的天才之处,也是它的边界所在。

节点三:大模型的范式意义。 由此回望,大语言模型的范式突破不在于某个技术指标,而在于它完成了从"确定算法"到"不确定过程"的转变(见 4.2.4):系统不再追求一次性给出唯一确定答案,而是在持续的人机交互中演化;它以容纳矛盾的方式,整合了人类语料中彼此冲突的无数"眼中的世界"。在认识论隐喻的意义上,可以把这样的系统描述为"不同人眼中平行世界的叠加态":用户的一次提问,如同对叠加态的一次测量,系统于是给出一个"你所要看到的世界"——模型永远不会"终结",但时刻可以被使用,因为它已经完成了对这个世界之叠加态的某种模拟。菲茨杰拉德在散文《崩溃》中的名句——“检验一流智力的标准,是头脑中同时存在两种相反的观念,仍能保持行动的能力”——恰好为这种"接受不一致性"的新范式作了注脚〔74〕。而这种智慧在中国传统中早有渊源:老子主张天人合一、接受世界的矛盾与阴阳融合;从这一立场看,“确定性思维"不过是在一个充满矛盾的世界里取一个侧面说"世界就是这样”——“道可道"“名可名”,任何符号系统给出的,都只是世界的一个侧面。王阳明的看花公案(“你来看此花时,则此花颜色一时明白起来”,见 3.2.5)则是这一立场在"意识—世界"之边上的先声:观察即介入,呈现即同在。

值得一提的还有中国传统中一个古老的"人在回路"样本:卜筮。起卦,是对卦象模型的一次随机采样;断卦,则是问卦者在与符号系统的交互中生成意义——答案从来不写在卦里,而完成于人的解释之中(详见 3.3)。不论其经验效度如何,作为一种在不确定性之下辅助决断的符号技术,它的结构本身就值得分析:它以模型的不完备为前提,以人的在场为闭环——这恰是本节所论范式的前现代预演。龟甲与蓍草之后三千年,人向机器提问,机器叠加万象以答——形式已非,结构犹存。

这条弧线与本文的哲学主线严丝合缝:第二章证明"名"的系统不可完备,第三章论证"实"永远溢出"名”,那么一个诚实的智能系统就不应该以"封闭、确定、完备"为设计理想,而应该以"开放、交互、持续修正"为存在方式——“人在系统内"不是对机器能力的妥协,而是对名实关系这一根本处境的承认。

6.4 人机共生:AGI 的重新定义与科研新形态

由此,AGI(通用人工智能)的定义本身值得重估。以"复刻一个全能的、独立于人的人类智能"为目标的 AGI 想象,仍被囚禁在"让人走开"的旧范式里;而本文所勾勒的方向提示另一种定义:AI 作为人类"语言—数学—物理"认知能力的延伸,作为人类认识世界的高维测量工具与思维共生体——其价值不在于离开人之后还能做什么,而在于与人结合之后,人类整体能做什么。

纳维-斯托克斯难题的攻克,为这一定义提供了第一个完整的实景样本〔1〕:人类设定问题与方向(把全部变体分配给不同智能体组、在欧拉方程突破后果断调整资源),机器群体在符号空间中高速探索(一万智能体、近五百万条消息、八十八小时),人类再用可执行的形式语言(Lean)为结果盖上确定性的印鉴——“想"由机器群体完成,“验"由形式系统担保,“问"与"断"仍握在人的手中。这正是"天启图灵机"的工业实现:机器在不可判定处求问天启,而这一次,人与机器互为彼此的天启。AI for Science 的更大图景——从 AlphaFold 解析蛋白质结构〔75〕,到 AlphaGeometry、AlphaProof 在数学奥赛中摘牌〔76〕,再到千禧年难题的攻克——都在重演同一个范式:不确定性思维(生成、探索、容忍矛盾)与确定性思维(验证、演绎、机械核验)在人机回路中的螺旋上升

人机互为天启:纳维-斯托克斯攻克中的认知回路

由此得到的展望可以收束为两句话:大语言模型给了人类一个认识智能的新的可操纵的实验场;而实验的方法论,正从"让人走开"的确定性,转向"人在系统中"去接受与认识不确定性。人机共生的未来,不是机器取代人的未来,而是人类第一次拥有了一面足够强大的镜子——借以重新认识自己如何说话、如何推理、如何在世界中存在。

第七章 结论

7.1 总结:从"悬浮的符号推演"走向"具身的物理理解”

本文以一个事件开篇:2026 年 9 月,约一万个 AI 智能体以语言为工具、以形式化验证为担保,解决了纳维-斯托克斯方程存在性与光滑性这一千禧年难题〔1〕。我们把它读作一个哲学寓言——纯符号系统回答了一个关于物理世界的问题——并由此展开了对"符号—意识—世界"三重关系的完整考察。现在,可以将各章的论证收拢为一条连续的线索。

符号极的内部(第二章):人类为追求确定性,曾试图把数学彻底沉淀为机械可验的形式语言(莱布尼茨—弗雷格—罗素—希尔伯特);哥德尔与图灵从内部证明了这个梦想的限界——足够强的符号系统必然不完备、不可完全判定。但形式化之梦并未死去,而是改换了形态:在大语言模型中,数学推理第一次完全以语言活动的形态展开,而 Lean 式的机器核验则把"验"的确定性理想推向极致。“想"与"验"在机器中的分工,正是"可说的"与"可证的"之间那条永恒裂缝的工程化安排。

符号—世界之边(第三章):西方从《克拉底鲁篇》的名实之问出发,经皮尔士的三元符号学、早期维特根斯坦的图像论(名与实同构)抵达后期维特根斯坦的语言游戏(意义在使用中生成);中国从孔子正名、名家指物之辨出发,经荀子"约定俗成”、言意之辨"得意忘言”,抵达王阳明"知行合一”——而《易传》“立象尽意"的象符号传统(阴阳五行、太极八卦、天干地支)则提示了第三条道路:当"名"不足以尽"实”,就升维为以结构变换模拟世界的模型性符号。两条传统最终在可计算性的边界处相遇——图灵-丘奇论题说"凡能说清楚的皆可模拟”,老子说"道可道,非常道":西方用数学证明名不可尽实,中国用直觉体认名不可尽实。

意识第三极的浮现(第三至六章):心学的"心外无物"与唯识宗的"万法唯识",早已把视线引向"意识—世界"之边——世界之呈现,总已是意识中的呈现;阿赖耶识"种子—现行—熏习"的循环,则是"内部表征建构世界"这一命题最古老的东方版本。在西方,布伦塔诺的意向性概念点明了"符号—意识"之边的核心难题:机器符号的"关于性"是派生的。中文房间与符号接地问题沿此否决了句法的自足性,查默斯的"困难问题"则为这一极划出了至今无人逾越的边界。

人工智能史的哲学结构(第四、五章):AI 的七十年是"名"逼近"实"的三种方式——映射(符号主义)败于符号系统的不完备与接地缺失,两次寒冬是确定性思维局限的历史显影;仿真(LLM)在语言使用中涌现出惊人的世界知识,却困于悬浮于物理之外的"离岸计算",幻觉与莫拉维克悖论是其结构性症候;交互(世界模型与具身智能)则构成正反合——向内重建"实"的模型(机器时代的"象"),向外接受"实"的校验(物理反馈作为符号接地的关键路径、机器意义的 index 维度),并以"知行合一"完成意义的闭环。珀尔的因果三阶梯为这条上升路线标出了刻度:从关联,到干预,到想象。

未来的方向(第六章):量子计算改变的是复杂度而非可计算性,它是算力的期权而非范式的革命;彭罗斯的非计算性质疑仍是悬在 AGI 头顶的达摩克利斯之剑,必须以假说的身份被严肃对待;而真正深刻的转变发生在认知范式层面——从天启图灵机到图灵测试再到大语言模型,“人在系统内"取代"让人走开”,接受不一致性取代消解不一致性,人机共生的螺旋(机器生成、形式验证、人类设问与决断)已在纳维-斯托克斯的攻克中显形。

由此,本文的核心命题获得了它的完整论证:人工智能的发展,确是人类利用符号系统(数学与语言)对客观现实进行映射、仿真与交互的认知演化史;其演进的总体方向,是从"悬浮的符号推演"走向"具身的物理理解";而贯穿三阶段始终的第三极——意识——也随演化的深入,从背景一步步走向前台。

7.2 终极启示:镜子

最后,让我们回到那个最古老的问题。

二千三百年前,庄子已经看破:在符号系统内部,“以指喻指”,永无出路——指不能指月,名不能尽实。四百年前,伽利略却满怀信心:宇宙这本大书是用数学语言写成的。一百年前,哥德尔与图灵证明了这场和解的限度:哪怕在数学这座最坚固的堡垒内部,名也无法穷尽自身。七十年前,图灵为机器智能立下判据,并悄悄地把判定的权杖交还给人。几天前,一万个不知疲倦的"名"的操纵者,在人类设定的方向下,解开了一道关于"实"的百年谜题。

这条线索指向的启示是双重的。

其一,关于机器。 AI 的每一步突破,都是人类重新划定"可名"与"不可名"之边界的一次尝试。符号主义试图把世界搬进名,失败了;大语言模型让名自身涌现出世界的投影,成功了却又悬空着;世界模型与具身智能让名第一次真正触碰实——但"认指为月"的古老警告依然有效:无论机器的模型多么逼真,模型终究不是世界本身。对 AI 最健康的期待,不是造出一个终结名实之辨的全知者,而是造出一个让我们能以新的方式逼近实的伙伴。

其二,关于人。 人类创造 AI 的过程,本质上是人类重新认识自身意识、语言界限与客观世界关系的一面终极镜子。在本文的三角形中,这句话可以获得更精确的形态:AI 是人类造出的第一个占据"符号"顶点、同时向"意识"与"世界"两个顶点延伸的人工物——它以符号为体,以交互触世界,以类心智的表现逼问意识。我们造出的每一台机器,都是一次自我实验:符号主义让我们看清了规则不能穷尽常识,大语言模型让我们惊异于意义竟能从使用中自行生长,具身智能让我们重新发现身体与行动的尊严,而彭罗斯式的质疑与"困难问题"则提醒我们——人之为人的最后秘密,可能恰恰藏在那片"不可名"的海域里。大语言模型给了人类一个认识智能的新的可操纵的实验场;本文愿在此基础上更进一步:这个实验场的最终实验对象,不是机器,而是我们自己——是"符号—意识—世界"这个我们栖居了千年的完整三角形。

镜子:AI 照见的是"符号—意识—世界"的完整三角形,也就是我们自身

“道可道,非常道”——但人类从未停止言说。“我们必须知道,我们必将知道”——但限界早已被数学自身证明。人工智能的全部戏剧,就上演在这两句箴言的张力之间。而这一次,观众与演员、镜子与镜中人,都是我们。


参考文献

〔1〕OpenAI. On the Navier–Stokes Millennium Prize Problem[EB/OL]. (2026-09-06)[2026-09-09]. https://openai.com/index/navier-stokes-solution/. 另见: Quanta Magazine. AI has solved one of math’s $1 million Millennium Prize problems[EB/OL]. (2026-09-08)[2026-09-09]. https://www.quantamagazine.org/ai-has-solved-one-of-maths-1-million-millennium-prize-problems-20260908/.

〔2〕TURING A M. Computing machinery and intelligence[J]. Mind, 1950, 59(236): 433-460.

〔3〕王怀民. 人工智能中的两种思维模式[R]. 华东师范大学"首届量子与老子国际论坛"讲座, 上海, 2024-07-07.

〔4〕SEARLE J R. Minds, brains, and programs[J]. Behavioral and Brain Sciences, 1980, 3(3): 417-424.

〔5〕HARNAD S. The symbol grounding problem[J]. Physica D: Nonlinear Phenomena, 1990, 42(1-3): 335-346.

〔6〕DREYFUS H L. What computers can’t do[M]. New York: Harper & Row, 1972. 修订版: DREYFUS H L. What computers still can’t do[M]. Cambridge, MA: MIT Press, 1992.

〔7〕VARELA F J, THOMPSON E, ROSCH E. The embodied mind: Cognitive science and human experience[M]. Cambridge, MA: MIT Press, 1991.

〔8〕MORAVEC H. Mind children: The future of robot and human intelligence[M]. Cambridge, MA: Harvard University Press, 1988.

〔9〕HA D, SCHMIDHUBER J. World models[C]//Advances in Neural Information Processing Systems 31 (NeurIPS 2018). 2018.

〔10〕LECUN Y. A path towards autonomous machine intelligence[R/OL]. 2022. https://openreview.net/forum?id=BZ5a1r-kVsf.

〔11〕CHOMSKY N, ROBERTS I, WATUMULL J. The false promise of ChatGPT[N/OL]. The New York Times, 2023-03-08.

〔12〕BENDER E M, KOLLER A. Climbing towards NLU: On meaning, form, and understanding in the age of data[C]//Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics (ACL). 2020: 5185-5198.

〔13〕PEIRCE C S. Peirce on signs: Writings on semiotic[M]. HOOPES J, ed. Chapel Hill: University of North Carolina Press, 1991.

〔14〕BRENTANO F. Psychologie vom empirischen Standpunkt[M]. Leipzig: Duncker & Humblot, 1874.

〔15〕COUTURAT L. La logique de Leibniz[M]. Paris: Félix Alcan, 1901.

〔16〕LEIBNIZ G W. Explication de l’arithmétique binaire[J]. Mémoires de l’Académie Royale des Sciences, 1703: 85-89.

〔17〕FREGE G. Begriffsschrift, eine der arithmetischen nachgebildete Formelsprache des reinen Denkens[M]. Halle: Louis Nebert, 1879.

〔18〕WHITEHEAD A N, RUSSELL B. Principia mathematica: 3 vols[M]. Cambridge: Cambridge University Press, 1910-1913.

〔19〕CHOMSKY N. Three models for the description of language[J]. IRE Transactions on Information Theory, 1956, 2(3): 113-124. 另见: CHOMSKY N. On certain formal properties of grammars[J]. Information and Control, 1959, 2(2): 137-167.

〔20〕GALILEI G. Il saggiatore[M]. Rome: Giacomo Mascardi, 1623.

〔21〕EINSTEIN A. 致 J. S. Switzer 的信[Z]. 1953-04-23. 中译见《爱因斯坦文集》相关版本.

〔22〕HILBERT D. Mathematische Probleme[J]. Nachrichten von der Gesellschaft der Wissenschaften zu Göttingen, Mathematisch-Physikalische Klasse, 1900: 253-297.

〔23〕HILBERT D. Radio address, Königsberg[Z]. 1930-09-08.

〔24〕GÖDEL K. Über formal unentscheidbare Sätze der Principia Mathematica und verwandter Systeme I[J]. Monatshefte für Mathematik und Physik, 1931, 38: 173-198.

〔25〕TURING A M. On computable numbers, with an application to the Entscheidungsproblem[J]. Proceedings of the London Mathematical Society, 1936, s2-42(1): 230-265.

〔26〕CHURCH A. An unsolvable problem of elementary number theory[J]. American Journal of Mathematics, 1936, 58(2): 345-363.

〔27〕柏拉图. 克拉底鲁篇[M]//柏拉图全集: 第二卷. 王晓朝, 译. 北京: 人民出版社, 2003.

〔28〕亚里士多德. 解释篇[M]//工具论. 李匡武, 译. 广州: 广东人民出版社, 1984.

〔29〕GILSON E. History of Christian philosophy in the Middle Ages[M]. New York: Random House, 1955. (中世纪唯名论与唯实论之争的背景文献)

〔30〕WITTGENSTEIN L. Tractatus logico-philosophicus[M]. London: Routledge & Kegan Paul, 1922. 中译本: 维特根斯坦. 逻辑哲学论[M]. 贺绍甲, 译. 北京: 商务印书馆, 1996.

〔31〕WITTGENSTEIN L. Philosophical investigations[M]. Oxford: Basil Blackwell, 1953. 中译本: 维特根斯坦. 哲学研究[M]. 李步楼, 译. 北京: 商务印书馆, 1996.

〔32〕孔子. 论语·子路[M]//朱熹. 四书章句集注. 北京: 中华书局, 1983.

〔33〕公孙龙. 公孙龙子[M]//王琯. 公孙龙子悬解. 北京: 中华书局, 1992.

〔34〕庄子. 庄子·齐物论[M]//郭庆藩. 庄子集释. 北京: 中华书局, 1961.

〔35〕胡适. 先秦名学史[M]. 上海: 学林出版社, 1983. 另见: 冯友兰. 中国哲学史[M]. 上海: 华东师范大学出版社, 2011.

〔36〕荀子. 荀子·正名[M]//王先谦. 荀子集解. 北京: 中华书局, 1988.

〔37〕老子. 道德经[M]//楼宇烈. 老子道德经注校释. 北京: 中华书局, 2008.

〔38〕周易·系辞上[M]//黄寿祺, 张善文. 周易译注. 上海: 上海古籍出版社, 2007.

〔39〕王弼. 周易略例·明象[M]//楼宇烈. 王弼集校释. 北京: 中华书局, 1980.

〔40〕楞严经: 卷二[M]//大正新修大藏经: 第19册. 东京: 大正一切经刊行会, 1924-1934.

〔41〕王守仁. 传习录[M]//吴光, 等. 王阳明全集. 上海: 上海古籍出版社, 1992.

〔42〕玄奘, 译. 成唯识论[M]//韩廷杰. 成唯识论校释. 北京: 中华书局, 1998. 另见: 《瑜伽师地论》《摄大乘论》等唯识学根本所依.

〔43〕NEEDHAM J. Science and civilisation in China: Vol. 2, History of scientific thought[M]. Cambridge: Cambridge University Press, 1956.

〔44〕GRAHAM A C. Yin-yang and the nature of correlative thinking[M]. Singapore: Institute of East Asian Philosophies, 1986.

〔45〕MCCARTHY J, MINSKY M, ROCHESTER N, SHANNON C. A proposal for the Dartmouth Summer Research Project on Artificial Intelligence[R]. 1955.

〔46〕NEWELL A, SIMON H. The logic theory machine[J]. IRE Transactions on Information Theory, 1956, 2(3): 61-79. 另见: NEWELL A, SIMON H. GPS, a program that simulates human thought[M]//Computers and Thought. 1963; WINOGRAD T. Understanding natural language[M]. New York: Academic Press, 1972.

〔47〕BUCHANAN B G, SHORTLIFFE E H. Rule-based expert systems: The MYCIN experiments of the Stanford Heuristic Programming Project[M]. Reading, MA: Addison-Wesley, 1984. (DENDRAL、MYCIN、XCON 等专家系统的代表性文献)

〔48〕FEIGENBAUM E A, MCCORDUCK P. The fifth generation: Artificial intelligence and Japan’s computer challenge to the world[M]. Reading, MA: Addison-Wesley, 1983.

〔49〕ALPAC. Languages and machines: Computers in translation and linguistics[R]. Washington, DC: National Academy of Sciences, 1966. 另见: LIGHTHILL J. Artificial intelligence: A general survey[R]. London: Science Research Council, 1973; MINSKY M, PAPERT S. Perceptrons[M]. Cambridge, MA: MIT Press, 1969.

〔50〕MCCARTHY J, HAYES P. Some philosophical problems from the standpoint of artificial intelligence[J]. Machine Intelligence, 1969, 4: 463-502.

〔51〕SEARLE J R. Intentionality: An essay in the philosophy of mind[M]. Cambridge: Cambridge University Press, 1983.

〔52〕MCCULLOCH W, PITTS W. A logical calculus of the ideas immanent in nervous activity[J]. Bulletin of Mathematical Biophysics, 1943, 5: 115-133. 另见: ROSENBLATT F. The perceptron: A probabilistic model for information storage and organization in the brain[J]. Psychological Review, 1958, 65(6): 386-408.

〔53〕RUMELHART D E, HINTON G E, WILLIAMS R J. Learning representations by back-propagating errors[J]. Nature, 1986, 323: 533-536.

〔54〕KRIZHEVSKY A, SUTSKEVER I, HINTON G. ImageNet classification with deep convolutional neural networks[C]//Advances in Neural Information Processing Systems 25 (NeurIPS 2012). 2012. 另见: VASWANI A, et al. Attention is all you need[C]//NeurIPS. 2017; KAPLAN J, et al. Scaling laws for neural language models[J/OL]. arXiv:2001.08361, 2020.

〔55〕SHANNON C. A mathematical theory of communication[J]. Bell System Technical Journal, 1948, 27: 379-423, 623-656. 另见: SHANNON C. Prediction and entropy of printed English[J]. Bell System Technical Journal, 1951, 30: 50-64.

〔56〕WIENER N. Cybernetics: Or control and communication in the animal and the machine[M]. New York: Wiley, 1948.

〔57〕BROOKS R. Intelligence without representation[J]. Artificial Intelligence, 1991, 47(1-3): 139-159.

〔58〕SCHRITTWIESER J, et al. Mastering Atari, Go, chess and shogi by planning with a learned model[J]. Nature, 2020, 588: 604-609.

〔59〕LI F F. With spatial intelligence, AI will understand the real world[Z/OL]. TED Talk, 2024-04. https://www.ted.com/talks/fei_fei_li_with_spatial_intelligence_ai_will_understand_the_real_world. 另见: World Labs 成立公告 (2024-09).

〔60〕OpenAI. Video generation models as world simulators[R/OL]. 2024-02. https://openai.com/research/video-generation-models-as-world-simulators.

〔61〕PEARL J, MACKENZIE D. The book of why: The new science of cause and effect[M]. New York: Basic Books, 2018.

〔62〕BROHAN A, et al. RT-2: Vision-language-action models transfer web knowledge to robotic control[J/OL]. arXiv:2307.15818, 2023. 另见: Physical Intelligence. π0: A vision-language-action flow model for general robot control[J/OL]. arXiv:2410.24164, 2024.

〔63〕DEUTSCH D. Quantum theory, the Church-Turing principle and the universal quantum computer[J]. Proceedings of the Royal Society of London A, 1985, 400: 97-117.

〔64〕SHOR P. Algorithms for quantum computation: Discrete logarithms and factoring[C]//Proceedings of the 35th Annual Symposium on Foundations of Computer Science (FOCS). 1994: 124-134. 另见: GROVER L. A fast quantum mechanical algorithm for database search[C]//Proceedings of the 28th Annual ACM Symposium on Theory of Computing (STOC). 1996: 212-219.

〔65〕PRESKILL J. Quantum computing in the NISQ era and beyond[J]. Quantum, 2018, 2: 79.

〔66〕CHALMERS D. Facing up to the problem of consciousness[J]. Journal of Consciousness Studies, 1995, 2(3): 200-219. 另见: CHALMERS D. The conscious mind: In search of a fundamental theory[M]. New York: Oxford University Press, 1996.

〔67〕BAARS B. A cognitive theory of consciousness[M]. Cambridge: Cambridge University Press, 1988. 另见: TONONI G. An information integration theory of consciousness[J]. BMC Neuroscience, 2004, 5: 42.

〔68〕PENROSE R. The emperor’s new mind: Concerning computers, minds, and the laws of physics[M]. Oxford: Oxford University Press, 1989. 另见: PENROSE R. Shadows of the mind: A search for the missing science of consciousness[M]. Oxford: Oxford University Press, 1994.

〔69〕HAMEROFF S, PENROSE R. Orchestrated reduction of quantum coherence in brain microtubules: A model for consciousness[J]. Mathematics and Computers in Simulation, 1996, 40(3-4): 453-480. 另见: PENROSE R, HAMEROFF S. Consciousness in the universe: A review of the ‘Orch OR’ theory[J]. Physics of Life Reviews, 2014, 11(1): 39-78.

〔70〕LUCAS J R. Minds, machines and Gödel[J]. Philosophy, 1961, 36(137): 112-127.

〔71〕TEGMARK M. Importance of quantum decoherence in brain processes[J]. Physical Review E, 2000, 61(4): 4194-4206.

〔72〕HAMEROFF S, et al. 对 Tegmark 反驳的回应(Physical Review E 同期评论, 2002 前后); 另见文献〔69〕2014 年综述中的修正估算.

〔73〕TURING A M. Systems of logic based on ordinals[J]. Proceedings of the London Mathematical Society, 1939, s2-45(1): 161-228.

〔74〕FITZGERALD F S. The crack-up[J]. Esquire, 1936(2-4月连载).

〔75〕JUMPER J, et al. Highly accurate protein structure prediction with AlphaFold[J]. Nature, 2021, 596: 583-589.

〔76〕TRINH T, WU Y, LE Q, et al. Solving olympiad geometry without human demonstrations[J]. Nature, 2024, 625: 476-482. 另见: Google DeepMind. AI achieves silver-medal standard solving International Mathematical Olympiad problems[EB/OL]. (2024-07-25).