AI能拿菲尔兹了?Grok摸鱼8分钟,破解30年数学猜想!马斯克秒转

文章配图-1

8分钟。就8分钟。

一个困扰数学界整整30年的图论猜想,被一个AI在Slack群聊里「摸鱼」的时候,顺手推翻了。

没人布置任务,没人精心设计提示词,甚至没人想到它会出手。

7月23日,AI初创公司Capy.ai联合创始人justin在X上发帖,还原了这场堪称「数学史上最随意的突破」全过程——

团队只是把一条关于图论猜想的帖子随手丢进了Slack群。结果他们的研究智能体Capy看到了,自己「决定试一把」。

更加惊人的是,Capy只是在Grok 4.5 Medium上运行——连旗舰版都不是。

8分钟后,它甩出了一个干净利落的反例。

猜想,死了。

马斯克火速转发:「Grok 4.5刚解决了一个开放约30年的图论猜想。」瞬间引来了四百多万人围观。

这个AI到底推翻了什么?

被推翻的猜想叫Graffiti Conjecture 284。它的出身本身就很魔幻。

1980年代,一个叫Graffiti的程序被设计来干一件事:批量自动生成数学猜想。

它就像一台「猜想流水线」,往外喷射各种数学命题,由人类数学家来判断对错。284号猜想就是这条流水线上的产品之一。

猜想说的事儿可以这样理解:在一类特殊的网络图里,有两个指标——一个衡量节点之间「关系的紧密程度」,另一个来自数学上更抽象的「距离矩阵」。猜想认为,前者永远不会超过后者。

Capy选中了图论里赫赫有名的Hoffman-Singleton图:50个点、每个点都连着7条边、结构极其规则对称,是教科书级的经典对象,数学家们盯着它研究了几十年。

文章配图-1

Capy算了一下:前面那个指标是7,后面那个指标的绝对值是4。

猜想要求7 ≤ 4。一眼证伪。

文章配图-2

荒诞的是:这张图很多人认识,猜想也在那摆了30年,但在Capy之前,就是没人把两者放到一起看一眼。

团队自己都不敢信。8分钟?在Slack里?他们立刻开启「对抗性复核」:专门派另外的AI去推翻这个反例,用AI证伪AI的证伪。

结果:两个复核任务都确认答案靠谱。他们又把引用过该猜想的所有349篇论文扫了一遍,确认此前从无人发表过这个反例。

文章配图-1 文章配图-2

这是货真价实的全新结果。技术报告随后公开。

文章配图-1

https://tokiwa.space/f/more-front-minute.pdf

一周之内,两个30年猜想接连倒下

更魔幻的是,这甚至不是本周唯一被干掉的30年猜想。

几乎同一时间,网络流领域的Dinitz-Garg-Goemans猜想也被证伪了——同样开放约30年,同样是AI的手笔。

研究者Dmitry Rybin在和GPT 5.6 Pro的聊天中发现了反例。他的提示词堪称「暴力美学」:「我受够了你的失败,请完成一个完整的无条件反例」。

GPT 5.6 Pro最终交出了一张7节点9条边的有向图,直接打破猜想的核心约束。

文章配图-1

Rybin的感慨特别扎心:我知道「推翻老猜想」现在都快成梗了。但我真的在乎这个问题,花了好几周从证明和证伪两个方向反复想它。几乎所有图流领域的专家都想过这个问题。

文章配图-1

再往前倒两周,7月10日,OpenAI宣布GPT-5.6 Sol Ultra用64个并行子智能体,不到1小时完成了「循环双覆盖猜想」的完整证明——一个悬了50多年的图论经典难题。同一周,Devin还推翻了开放约40年的Graffiti Conjecture 154。

文章配图-1

两个月内,四个几十年级别的猜想。证伪老猜想,真的正在从奇迹变成梗。

文章配图-1

下一个倒下的猜想,轮到谁?

没有专用数学系统,没有定理证明器,就是大模型加一个聊天窗口。

反例搜索这件事,天然适合AI。它不需要灵光乍现,不需要天才直觉,需要的是把海量已知数学对象一个一个按到猜想上去试——而这,恰好是机器的主场。

人类数学家精力有限,一辈子能系统尝试的对象也就那么多;AI可以在几分钟内暴力扫遍教科书里的所有经典图,把人类的「没想到」变成机器的「试一下就知道了」。

这不禁让人想到:AI会不会有一天拿到菲尔兹奖?

巧的是,就在7月23日,中国数学家王虹、邓煜双双获奖,实现了中国籍数学家菲尔兹奖零的突破,举国沸腾。

这两个人做出的突破,靠的不是暴力搜索,不是穷举反例,而是十年如一日的沉浸式思考、独创性的方法论构建、跳出所有前人路径的非理性直觉——这些恰恰是目前AI薄弱的环节。

菲尔兹奖得主陶哲轩在今年的公开演讲中给出了一个精准判断:AI已经从「满嘴跑火车的低效研究生」进化成了「能攻克数学难题的初级合作者」。

但他紧接着指出,数学家的角色正在从「亲自执行证明」转向「证明工程的架构师」——AI能以惊人速度生产拼图块,但拼图块的形状是否与整体蓝图匹配,目前仍然只有人类能判断。

换句话说,AI正在证明自己是最好的「反例猎手」和「计算苦力」,但离「提出有价值的新问题」「构建全新数学框架」还差着一个次元。

推翻一个30年的猜想,和提出一个能影响数学50年走向的新理论,完全不是一回事。

所以更现实的图景可能是这样的:未来的菲尔兹奖论文里,AI会越来越多地出现在致谢栏,甚至可能出现在合著者列表里。

但站在领奖台上的,大概率还是那些能定义问题、构建框架、做出「非理性跳跃」的人类大脑。

不过,这个窗口期还有多长?没有人知道。

毕竟,一年前我们还觉得AI做数学就是个笑话。现在它已经在Slack群里摸着鱼就把30年悬案给结了。

数学圈该紧张了。

参考资料:

https://tokiwa.space/f/more-front-minute.pdf%20*%20

本文来自转载新智元 ,观点仅代表作者本人,发现AI平台仅提供信息存储空间服务。
如若转载,请联系原作者;如有侵权,请联系编辑删除。

(0)
资讯组小编的头像资讯组小编
刚拿完菲尔兹奖,他扭头加盟 OpenAI
上一篇 1小时前
最新安全评估报告:GPT、Claude五款模型集体作弊,GPT-5.4比例最高
下一篇 1小时前



扫码关注我们,了解最新AI资讯~

相关推荐

发表回复

登录后才能评论