陶哲轩警示数学百年危机:AI引发证明过剩与价值重构
在2026年国际数学家大会(ICM)的聚光灯下,当公众的目光还沉浸在王虹与邓煜荣获菲尔兹奖的辉煌时刻时,一位站在数学界权力与智慧顶端的人物——陶哲轩,却选择在此刻拉响警报。这位曾被视为人工智能乐观派代表的顶尖数学家,用“百年危机”这样沉重的词汇,重新定义了当前数学界所面临的挑战。这并非危言耸听,而是基于对技术演进与学科本质深刻洞察后的理性预警。回顾历史,上一次数学界使用“危机”一词,还要追溯到二十世纪初的罗素悖论与哥德尔不完备定理时期。那场危机迫使数学家们回头审视逻辑地基,最终建立了严格的公理化体系。而陶哲轩指出,当下的危机不再关乎逻辑的真伪,而是直指数学研究的核心价值观与实践方法论。
为了剥离情绪与商业利益的干扰,陶哲轩在演讲中采取了一种极具数学思维的“工作假设”策略。他引用了独立评测机构First Proof的数据,显示在受控条件下,AI系统已能以每道题10至1000美元的成本,解决具有研究级难度的全新数学问题,且质量达到可发表标准。面对这一既定事实,争论AI是否具备数学能力已无意义。真正的核心问题在于:当解题这一传统上由人类垄断的高智力活动变得廉价且批量化的时候,数学家存在的根本意义是什么?如果剥离了解题的光环,数学研究的终极目标究竟指向何方?这一追问,直接将讨论从技术层面提升到了哲学与社会学的高度。
在传统的数学研究范式中,解决未解问题、发展新理论、培养人才以及构建学术共同体等目标是高度绑定的。一个大问题的解决往往能同时推动多个维度的进步。然而,陶哲轩引入了经济学中的古德哈特定律,即“当一个度量成为目标,它就不再是一个好的度量”。在生成式AI的催化下,这种绑定关系正在迅速瓦解。AI工具因其“不接地”的特性,极易在单一指标的优化中走向极端,导致数学研究各环节的目标发生脱钩。陶哲轩通过推演“解题”这一单一任务的KPI演变,清晰地展示了这一过程的荒谬性与危险性。
最初的目标仅仅是解决尽可能多的未解问题,但这导致了大量错误证明的泛滥。于是,目标修正为“解题并验证正确性”。随着Lean等证明助手的普及,机器验证变得高效,但新的困境随之而来:AI生成的证明可能长达数万行,虽然机器判定无误,却没有任何人类能够理解其内在逻辑。这种现象在Erdős遗留问题网站上已初现端倪,大量AI提交的证明因无人愿意或能够核验而处于悬置状态。我们可能面临这样一个悖论:拥有一个被机器验证为真的重大定理,却没有任何人类能将其转化为可理解的知识。
为进一步应对这一困境,目标再次升级为“解题、验证并清晰传达”。然而,当前AI在数学写作上的表现呈现出一种诡异的“完美陷阱”。其拼写、语法无可挑剔,但在关键逻辑转折处往往一笔带过,而在琐碎细节上过度啰嗦。这种丝滑的阅读体验掩盖了思维的难点,使得读者产生“已懂”的错觉,实则未能留下任何深刻的认知印记。陶哲轩敏锐地指出,人类表述中的瑕疵、停顿甚至困惑,恰恰是思维传递过程中不可或缺的锚点。他引用Thurston的观点强调,数学的成功不在于生产抽象的证明配额,而在于能否让他人更清晰地思考。那些边骂边啃、充满批注的手稿,才是数学传承的真实载体。
因此,目标必须继续迭代,纳入“被共同体消化和接受”这一维度。这是一个依赖人类志愿劳动、声望积累以及长期互动的过程,无法由作者与AI单方面加速。最终,陶哲轩提出了包含“正典化”在内的完整价值链:生成、验证、表述、发表、正典化。其中,将成果写入教科书、融入下一代人的思维框架,是流程中最慢但价值最高的环节。AI目前的强大能力,正是建立在人类数百年来构建的正典理论基石之上。若这一基石因过度追求速度而松动,AI的智力大厦也将随之崩塌。
将这一工作假设代入现实,陶哲轩诊断出数学界正患上严重的“证明消化不良”。由于各环节流速的严重阻抗失配,AI生成的证明堆积在验证环节,验证后的成果淹没在同行评审中,而已发表的文献又多到共同体无力整理。数学界正从延续数千年的“证明稀缺”时代,急剧滑向“证明过剩”时代。原有的荣誉体系、评价机制均建立在稀缺性基础之上,当地基松动,整个学术生态将面临重构的压力。
面对这一系统性风险,陶哲轩并未主张退回前AI时代,而是提出了基于《莱顿人工智能与数学宣言》的应对策略。首要原则是透明化,要求全面披露AI的使用情况,避免陷入集体隐瞒的道德困境。更为关键的是,必须重新调整评价权重,降低“第一个解出”的荣耀,大幅提升“消化”与“解释”的价值。他提出了一条铁律:如果作者不能就其成果进行一场清晰、专家水平且归属得当的报告,该成果便不应发表。换言之,AI可以辅助解题,但人类必须掌握解释权。无法被人类理解的真理,在数学的社会属性中是无效的。
此外,陶哲轩特别强调在教育、招聘及经费申请等涉及人的领域,应严格限制AI的介入,以保护属人的判断力与创造力。在其他研究领域,数学界应主动制定规则,而非被动适应科技公司的产品逻辑。他在演讲结尾展示的PPT细节颇具深意:一方面标注所有破折号均为人类生成,另一方面坦诚使用了AI进行文本补全。这种“不拒绝、不隐瞒、自主定规”的态度,或许正是度过此次危机的最佳姿态。一百年前的危机换来了更坚实的逻辑地基,而这一次,若能妥善处理,数学界有望建立起以理解与传承为核心的新价值体系,确保在智能时代,数学依然是人类理性最璀璨的灯塔。