AI消息速览

AI推翻80年数学猜想,菲尔兹奖得主一夜没睡:以为要出局

事件日期 2026-05-28 · 产业观察 · 已接受

事件日期2026-05-28
信息日期2026-05-28
入库日期2026-08-08
通道产业观察
状态已接受
来源新智元

知识卡片:AI推翻80年数学猜想,菲尔兹奖得主一夜没睡:以为要出局

  • 英文标题:原报道未提供英文标题;中译名可作“AI Overturns 80-Year-Old Math Conjecture; Fields Medalist Loses Sleep, Thinking He’d Be Out”
  • 英文关键词:AI for mathematics; unit distance conjecture; Jacobian conjecture; proof glut; Timothy Gowers; Terence Tao; ICM 2026

一句话结论

据新智元报道,AI在2026年5月至8月连续“攻入”多个长期未解的数学问题:推翻了埃尔德什单位距离猜想、给雅可比猜想在高维找到反例,并在第三方评测中达到“可发表”水平;但多位数学家认为,AI真正加速的是生成与验证证明,而人类的理解、解释和共同体传承仍是数学的核心,数学正在从“证明稀缺”走向“证明过剩”。

事件概述或研究问题

  • 2026年5月,OpenAI一个尚未公开的内部模型推翻了埃尔德什1946年提出的单位距离猜想,该猜想悬置约80年,普林斯顿的Noga Alon称它“大概是离散几何里最有名的问题”。
  • 2026年7月,Anthropic研究员Levent Alpöge发推称,Claude Fable找到了雅可比猜想(Jacobian conjecture)在高维的一个反例。
  • 2026年8月,OpenAI公布了内部版Astra在数学和理论计算机科学上的十项进展,涉及高维球堆积、群论、格密码学等。
  • 记者Kai Williams在费城ICM大会(2026年7月)上询问20多位数学家,多人短期态度乐观,但普遍把AI视为工具而非替代者。

方法/产品要点

  • 涉及AI系统:OpenAI未公开内部模型、OpenAI内部版Astra、Anthropic的Claude Fable。
  • 报道称,上述结果消耗的token按“Sol”的API价计算总计约2000美元(计价口径待核实)。
  • 不到24小时,Levent Alpöge宣布用已公开的Fable复现了OpenAI十项进展中的5项。
  • 第三方评测:2026年5月28日,“First Proof”独立评测用10道未公开研究级新题测试4套AI系统,专家按正确性和表达质量评审,其中7道至少被一套系统做到可发表水平。

主要结果或产业意义

  • 陶哲轩在2026年7月24日ICM大会演讲中提出,AI能瞬间加速数学成果“一生”六步中的前两步(生成证明、验证正确),但后四步(清楚写明白、正式发表、被同行消化、正典化)仍极度依赖人。
  • 他称数学正从“证明稀缺”时代进入“证明过剩”时代,并警告可能出现“证明消化不良”:结果被证明且验证正确,却没有人能理解或解释。
  • erdosproblems.com上已堆了几十份AI生成的证明,很多可能正确,但尚无专家逐一核验、背书。
  • 产业意义:AI以极低成本批量产出研究级数学结果,可能改变AI能力评测、科研出版、验证机制和数学教育的形态。

与既有脉络的关系

本条是已有相关卡片中“AI破解30年图论猜想”这一脉络的延续和放大:不再是孤立事件,而是在三个月内集中出现多项长期数学难题被AI突破,并引发陶哲轩、Gowers等领军人物的系统性反思。相较Epoch AI的研究趋势页面,本条提供了具体的数学事件、ICM 2026演讲和数学家访谈素材。

为什么重要

  • 突破“无人区”:单位距离猜想和雅可比猜想都是长期未解问题,AI取得反例/进展,说明AI已不限于教科书题或已知方法。
  • 引发学科价值反思:如果AI能生成大量正确但人类无法理解的证明,数学共同体、知识传承和“解题”作为核心指标的价值都会受到冲击。
  • 改变“AI能否做数学”的提问方式:邓煜认为未来可能是数学家提出新框架,AI做技术细节,但“什么叫技术细节”会被重新定义。
  • 陶哲轩用“证明过剩”和“证明消化不良”提出了新的治理与传播问题,适用于更广泛的AI知识生产讨论。

局限与不确定性

  • 材料未说明单位距离猜想、雅可比猜想反例及Astra十项进展是否已经同行评议或正式发表,需待核实。
  • OpenAI内部模型、内部版Astra的具体能力、训练方式与访问方式未公开;Claude Fable的能力边界也未详细说明。
  • “约2000美元”成本依赖“Sol”的API价格,具体统计口径和计算方法未在材料中展开。
  • “10道中7道可发表”只是单次评测结果,样本量小,评价标准需以First Proof原报告为准。
  • 数学家态度存在明显分歧(如Gowers悲观、Litt乐观),不构成共识;AI未来是“撞墙”还是“继续突破”仍不可确定。

可用于图书/PPT/简报的角度

  • 时间线梳理:2026年5月/7月/8月三个AI数学突破事件一览。
  • 概念工具:陶哲轩的“证明六步”“证明过剩”“证明消化不良”,可用于AI治理、科研政策和知识生产议题。
  • 辩论素材:Gowers的悲观 vs. Litt的乐观;邓煜的“AI会帮数学家而不是取代他们”。
  • 数据点:First Proof评测7/10、约2000美元token成本、20多位数学家访谈。
  • 结尾金句:“答案会过剩,但人类的理解永远不会。”(来自报道末尾)

原始材料

  • 原报道标题:AI推翻80年数学猜想,菲尔兹奖得主一夜没睡:以为要出局
  • 来源:新智元;转载于AIERA
  • URL:https://aiera.com.cn/2026/08/08/other/admin/108247/ai%e6%8e%a8%e7%bf%bb80%e5%b9%b4%e6%95%b0%e5%ad%a6%e7%8c%9c%e6%83%b3%ef%bc%8c%e8%8f%b2%e5%b0%94%e5%85%b9%e5%a5%96%e5%be%97%e4%b8%bb%e4%b8%80%e5%a4%9c%e6%b2%a1%e7%9d%a1%ef%bc%9a%e4%bb%a5%e4%b8%ba
  • 报道引用的参考资料:
    • https://www.understandingai.org/p/mathematicians-are-grappling-with
    • https://teorth.github.io/tao-web/slides/age-of-ai-icm-2026.pdf