返回列表
AI 挑战人类数学家:ChatGPT 证伪埃尔德什单位距离猜想并实现自动形式化验证
研究突破人工智能数学形式化验证

AI 挑战人类数学家:ChatGPT 证伪埃尔德什单位距离猜想并实现自动形式化验证

2026年5月,人工智能在纯数学领域取得重大突破。ChatGPT 成功构造出反例,推翻了离散几何中著名的埃尔德什(Erdős)单位距离猜想。该证明利用了 20 世纪 60 年代的 Golod-Shafarevich 定理。随后,由图灵奖得主 Yann LeCun 联合创立的 Logical Intelligence 公司在不到一周内实现了该证明的 Lean 自动形式化,并得到了 Fields 奖得主 Mike Freedman 及专业数学家的验证。这一事件标志着 AI 在数学反例构造与逻辑验证方面已展现出超越人类的潜力。

Hacker News

核心要点

  • 重大突破:ChatGPT 于 2026 年 5 月 20 日成功证伪了离散几何领域的埃尔德什(Erdős)单位距离猜想。
  • 证明路径:AI 利用 1960 年代 Golod 和 Shafarevich 的深奥数论定理构造出了该猜想的反例。
  • 自动形式化:Logical Intelligence 公司的 AI 系统在不到一周内将 ChatGPT 生成的论文自动转化为 Lean 形式化语言。
  • 权威验证:包括 Fields 奖得主 Mike Freedman 在内的多位顶尖数学家对证明及形式化结果进行了审核与确认。

详细分析

埃尔德什猜想的陨落与 AI 的逻辑跃迁

2026 年 5 月 20 日,ChatGPT 成功推翻了困扰数学界多年的埃尔德什单位距离猜想。这一进展最初通过人类数学家的证词得以传播,他们获得了早期访问权限并对 AI 生成的论证进行了初步核实。该证明的核心结构非常精妙,它并非简单的计算堆砌,而是巧妙地运用了 Golod 和 Shafarevich 在 1960 年代提出的数论定理来构造反例。这表明 AI 在处理高阶数学逻辑和跨领域理论结合方面,已经达到了能够产生原创性科学突破的水平。

从自然语言到 Lean:自动形式化的新纪元

在 ChatGPT 发布证明后仅一周(2026 年 5 月 26 日),由图灵奖得主 Yann LeCun 联合创立的 Logical Intelligence 公司便取得了进一步突破。该公司首席科学官、Fields 奖得主 Mike Freedman 透露,他们的 AI 系统已实现了该证明的“自动形式化”。这意味着 AI 能够将自然语言描述的数学论文直接转化为 Lean 交互式定理证明器可识别的代码。经过专业数学家 Kevin Buzzard 及其博士后 Thomas Browning 的检查,确认该系统准确地在 Lean 环境中重构了整个证明。这一过程极大地缩短了传统数学证明从提出到被机器严密验证的周期。

行业影响

该事件对 AI 行业和数学研究领域具有深远意义。首先,它证明了 AI 不仅仅是辅助计算的工具,更是能够发现人类直觉盲区、构造复杂反例的“数学家”。其次,自动形式化技术的成熟解决了长期以来困扰形式化数学界的效率瓶颈。过去,将人类证明转化为机器可验证的代码需要耗费数月甚至数年,而现在 AI 可以在几天内完成。这将加速数学知识的库构建(如 mathlib),并可能改变未来科学发现的验证标准,使交互式定理证明器成为数学研究的标配。

常见问题

问题 1:什么是埃尔德什单位距离猜想?

这是由著名数学家保罗·埃尔德什提出的离散几何问题。ChatGPT 通过构造一个基于 Golod-Shafarevich 定理的反例,证明了该猜想在特定条件下不成立。

问题 2:为什么 Lean 形式化如此重要?

Lean 是一种交互式定理证明器。人类数学家在审查复杂证明时可能会出错,而 Lean 能够通过逻辑严密的计算机算法确保证明的每一步都绝对正确。实现自动形式化意味着 AI 生成的科学发现可以立即获得最高等级的逻辑确认。

问题 3:Logical Intelligence 公司在其中扮演了什么角色?

该公司由 Yann LeCun 等人创立,致力于 AI 逻辑推理。他们开发的系统成功将 ChatGPT 的自然语言证明自动翻译成了 Lean 代码,展示了 AI 在理解和转化高难度技术文档方面的卓越能力。

相关新闻

TutorMoments:AI 导师是否知道何时该提供帮助,何时该保持沉默?
研究突破

TutorMoments:AI 导师是否知道何时该提供帮助,何时该保持沉默?

本文探讨了由 AllenAI 在 Hugging Face 发布的 TutorMoments 项目。该研究聚焦于智能教学系统(ITS)中的核心挑战:AI 导师如何精准判断教学干预的时机。通过分析 AI 在“提供帮助”与“保持沉默”之间的权衡,该项目旨在提升 AI 导师的教学有效性,使其更接近人类导师的引导式教学风格。

研究突破

深度解析心灵计算理论:机器思维与人类认知的本质探索

本文基于斯坦福哲学百科全书关于“心灵计算理论(CTM)”的权威论述,探讨了心灵是否为一个计算系统的核心命题。文章回顾了CTM在20世纪60至70年代认知科学中的正统地位,分析了计算主义者面临的三大核心任务:定义心理计算、论证其存在性以及协调计算描述与神经生理及意向性描述的关系。尽管面临新兴范式的挑战,CTM仍是理解推理、决策和语言理解等心理过程的关键框架。

Science One 框架:Google 推出基于证据链的可验证自主研究新范式
研究突破

Science One 框架:Google 推出基于证据链的可验证自主研究新范式

Google Research 近日发布了名为 Science One 的通用科学研究框架。该框架的核心在于引入了“证据链”(Chain-of-Evidence)机制,旨在构建一个可验证的自主研究系统。通过这一创新,Science One 能够实现科学研究过程的自动化,同时确保每一个研究结论都具备可追溯的逻辑支撑,解决了 AI 在科学探索中面临的可信度与透明度难题。