A misalignment of AI in mathematics
1228 points • 3 days agoArticle Link

大型语言模型在数学能力上的最新进展已达到能够解决一些重要、长期难题的程度。尽管这很值得关注,许多数学界人士认为,AI 公司将数学作为性能基准的做法对该领域极为有害。企业的目标与数学专业的核心价值观存在根本错位,这也反映出人们对 AI 融入其他科研与创意领域影响的更广泛担忧。

研究数学的核心是理解形状、数与自然现象的基本结构。几代数学家积累了大量方法与抽象概念来探索这一领域。历来那些具有里程碑意义的问题如同灯塔,促使学界通过艰苦的协作与反复推敲产生新见解。从提出问题到获得发现,这一过程通过讲座、讨论与精细论证,最终形成可为学生理解并随着时间惠及社会的教科书式解法。

数学界依靠人与人之间的互动来培养学生、孕育新思想。学习与发现本质上是人的活动,需要时间让思想传播、与他人工作相互关联并融入集体范式。当 AI 系统被用来快速、大量地产生真假结论时,就有把关注点从概念理解转移开的风险。这种加速的产出可能绕过那些赋予数学成果持久意义与实际价值的关键人类工作。

与此同时,AI 生成的解法常常被匆忙公布,却没有充分记录底层方法或承认前人的贡献,因此关于署名与抄袭的担忧日益上升。如果这些系统在缺乏数学家监督、无法将成果整合进学科体系的情况下持续运作,人类知识传承的关键链条可能会被永久切断。这将损害把孤立的解题结果转化为累积且连贯的科学知识体系的过程。

归根结底,这个问题超越数学,触及整个社会。在任何智识领域,多年的严格训练旨在培养提出新问题的能力,而不仅仅是得到答案。随着 AI 能够直接交付这些成果,专业劳动的意义本身正受到质疑。这项技术究竟会成为推动真正进步的工具,还是削弱人类智力探究根基的力量,完全取决于今天掌控这些系统的人所作的选择。

1212 comments • Comments Link

• 数学界正努力应对由人工智能生成的证明,这些证明像"黑箱"一样:尽管得出正确结论,却绕过了传统且反复的人类论证、同行评审和概念整合过程。

• 一个主要担忧是,一些人工智能公司把高调的市场宣传"胜利"置于科学进步之上,经常抢在研究者之前发布成果,不尊重早期工作,从而在某种程度上对学术社区实施了知识层面的"拒绝服务"。

• 依赖人工智能以暴力穷举方式解决开放性问题,可能削弱数学发展的"中间地带",而恰恰是那些中间性的猜想和失败尝试,常常为新的且持久的见解提供最肥沃的土壤。

• 虽然有人认为人工智能会像国际象棋引擎提升选手水平那样推动数学大众化,但批评者强调两者在结构上并不相同:在国际象棋中,游戏本身依然存在,而人工智能有使数学的"结果"与赋予其文化和学术价值的"理解"脱钩的危险。

• 人们担心出现"审查过载"(即所谓的 slop fatigue):人工智能系统大量生成未经核实或难以理解的证明,超出人类专家对其整理、验证并纳入学科正典的能力范围。

• 批评者指出,数学是一项旨在建立共享知识基础的社会性、协作性事业。把它简化为一种自动化、孤立的输出机制,会让未来学者感到疏离,并阻碍原创性的学术探索。

• 目前学术界以先行权和荣誉为核心的激励机制,正与由人工智能驱动的格局发生冲突。在后者中,生成速度使传统的署名与荣誉体系显得越来越过时且更具争议。

• 有观察者将这种转变比作摄影技术进入艺术界:机器可以机械地复制或超越人类的产出,但人类的意图、挣扎与独特视角的丧失,会带来真实的文化衰退。

• 经济现实仍是主要驱动因素:私营人工智能实验室越来越受股价、营销效果和垄断智力资本潜力的驱动,而不是传统科学研究中那种长期、以公共利益为导向的目标。

• 尽管存在争论,但关于"进步"的定义仍存在难以消除的紧张关系。如果人工智能最终能迅速解决复杂问题,数学界可能面临身份危机:社会应更看重发现的"过程"还是发现的"真实性"?

这场讨论反映出数学作为一门累积性、社会性、以人为本的学科,与将数学视为单纯的工具性问题解决手段之间的根本张力。当前对人工智能实践的批评者并非必然反对技术本身,而是反对那些以激进、以营销为导向且孤立的方式部署这些工具——代价是牺牲既定的学术标准。支持者则认为,对以人为中心的过程、荣誉和"艰辛"过于执着,可能忽视快速科学进步带来的客观益处。最终,这场讨论凸显了一个令人不安的转折点:发现的工具开始超越用于理解并给这些发现赋值的制度与结构。