AI消息速览

AI在Slack群聊8分钟内破解30年图论猜想

事件日期 2025-05-14 · 产业观察 · 已接受

事件日期2025-05-14
信息日期2025-05-14
入库日期2026-07-25
通道产业观察
状态已接受
来源新智元

知识卡片:AI在Slack群聊8分钟内破解30年图论猜想

  • 一句话结论:2026年7月,一个未经过专门数学训练的研究智能体Capy(基于Grok 4.5 Medium)在Slack群聊中“摸鱼”时,8分钟内通过暴力搜索反例,推翻了开放30年的图论猜想Graffiti Conjecture 284,标志着AI已成为高效的“反例猎手”,但距离提出新理论的人类数学家仍有差距。

  • 事件概述
    2026年7月23日,AI初创公司Capy.ai联合创始人Justinsun在X上发帖,还原了其研究智能体Capy在Slack群聊中偶然看到一条关于图论猜想的帖子后,自行决定尝试破解。Capy运行在Grok 4.5 Medium上(非旗舰版),8分钟后输出一个反例,推翻了Graffiti Conjecture 284——一个由1980年代程序Graffiti自动生成、困扰数学界约30年的猜想。该反例基于经典的Hoffman-Singleton图(50个顶点,每个点7条边),计算得出猜想要求的不等式(7 ≤ 4)被证伪。团队随后通过“对抗性复核”(派其他AI试图推翻反例)和检查349篇引用论文,确认结果此前从未被人类发表。同日,马斯克转发该消息引发数百万围观。几乎同一周内,Dinitz-Garg-Goemans猜想(网络流领域,开放约30年)也被GPT-5.6 Pro证伪;再加上此前GPT-5.6 Sol Ultra完成的循环双覆盖猜想(50多年悬题)和Devin推翻的Graffiti Conjecture 154(40年),两个月内四个经典猜想被AI终结。

  • 方法/产品要点

    • 智能体:Capy(Capy.ai开发的研究智能体),基于Grok 4.5 Medium,无专门提示词或数学定理证明器,仅通过聊天界面进行暴力搜索反例。
    • 核心策略:AI将海量已知数学对象逐个套用在猜想上进行验证,无需“灵光乍现”或“非理性直觉”,依赖暴力穷举和计算能力。
    • 验证流程:团队使用另外两个AI分别进行对抗性复核(试图推翻反例),均确认反例有效;同时遍历引用该猜想的所有349篇论文,确认无人发表过此反例。
  • 主要结果或产业意义

    • 证伪了Graffiti Conjecture 284(图论),反例为Hoffman-Singleton图。
    • 同期另三个经典猜想被AI证伪或证明(Dinitz-Garg-Goemans猜想、循环双覆盖猜想、Graffiti Conjecture 154)。
    • 意义:AI在无需人类设定具体数学任务、无需专用数学系统的情况下,通过“摸鱼”式自主行为完成反例发现;证明AI在大规模反例搜索上已超越人类数学家的精力局限,可能改变未来数学研究的工作流(数学家从执行证明转向架构设计)。
  • 为什么重要

    • 增量信息:与已有知识卡片(如AlphaEvolve、AlphaEarth)不同,本事件强调AI在无明确指令下的自主数学突破,且模型并非专门为数学优化(Grok 4.5 Medium为通用对话模型)。它展示了AI从“工具”向“自发合作者”的演化趋势。
    • 挑战传统认知:此前AI数学突破多针对特定问题设计专用系统(如定理证明器),而本案中AI在聊天群内“顺手”完成,降低了AI参与数学研究的门槛。
    • 引发对“AI能否获菲尔兹奖”的讨论:目前AI擅长反例搜索和计算苦力,但提出新问题、构建新框架的能力仍待核实。
  • 局限与不确定性

    • 该方法局限于可穷举反例的猜想,不适用于需要复杂构造性证明或抽象理论创新的问题。
    • 反例搜索依赖已有数学对象库的覆盖范围,若猜想涉及极罕见结构,AI可能错过。
    • Graffiti Conjecture 284的证伪是否完全正确?团队已进行复核,但独立第三方验证尚未公开。
    • AI自主性的边界:Capy“决定试一把”的动机、是否受底层模型随机性影响,细节待核实。
    • 文章中“一周内多个猜想被AI破解”的陈述部分来自社交媒体帖子,正式论文同行评审状态待核实。
  • 可用于图书/PPT/简报的角度

    • “AI科学家”的萌芽:AI从一个段子(摸鱼)变成正经数学研究伙伴,可作“AI自主发现问题”的典型案例。
    • 数学研究模式变革:从人类手工反例搜索到AI暴力穷举,展示效率提升与范式转移。
    • 菲尔兹奖展望:对比人类数学家(如王虹、邓煜获奖)的创造性直觉与AI的计算优势,讨论未来AI是否可能成为合著者或获奖者。
    • 对AI素养的启示:通用大模型无需专门训练即可在特定领域取得突破,说明数据与计算力的指数增长正在吞噬更多专业壁垒。
  • 与既有脉络的关系

    • 本卡片是对AlphaEvolve(2025-05-14)的延续:AlphaEvolve主动设计算法,而本事件显示AI在不经提示下自主执行数学发现,二者共同表明AI从“被动执行”向“主动探索”进化。
    • 与GPT-5.6 Sol Ultra完成循环双覆盖猜想(2026-07-10)相比,本案更强调低算力(非旗舰版)、非意图性(Slack摸鱼)和极短时间(8分钟),突出了AI的“意外”潜力。
  • 原始材料

    • URL: https://aiera.com.cn/2026/07/25/other/admin/105795/ai%e8%83%bd%e6%8b%bf%e8%8f%b2%e5%b0%94%e5%85%b9%e4%ba%86%ef%bc%9fgrok%e6%91%b8%e9%b1%bc8%e5%88%86%e9%92%9f%ef%bc%8c%e7%a0%b4%e8%a7%a330%e5%b9%b4%e6%95%b0%e5%ad%a6%e7%8c%9c%e6%83%b3%ef%bc%81%e9%a9%ac
    • 英文标题(参考文章内容):Grok 4.5 Fells 30-Year-Old Graph Conjecture in 8 Minutes
    • 英文关键词:AI mathematical conjecture, Grok 4.5, Capy, Graffiti Conjecture 284, Graph Theory, Slack
    • Track: industry
    • Topics: ai-industry