首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
智能AI evening

一个「流浪」数学家的遗产,正在被AI公司疯抢

摘要

机器之心编辑部 2026 年 5 月 20 日,OpenAI 发了一条公告,震动了整个数学界。 他们一个还没公开的 AI 模型,推翻了匈牙利数学家 Paul Erdős 在 1946 年提出的一个猜想。这是 AI 第一次产出具有历史意义的数学证明 —— 而且不是在什么边缘问题上凑数,是在一个困扰了数学界 80 年的经典问题上,找到了一个没有人想到的反例(参见《 AI首次证明数学核心猜想:80年的经...

Erdős Bloom van Doorn OpenAI Paul 2025 机器之心编辑部 2026 发了一条公告
2026-08-18 1 阅读 约10分钟阅读 机器之心
分享:
字号:
机器之心编辑部 2026 年 5 月 20 日,OpenAI 发了一条公告,震动了整个数学界。 他们一个还没公开的 AI 模型,推翻了匈牙利数学家 Paul Erdős 在 1946 年提出的一个猜想。这是 AI 第一次产出具有历史意义的数学证明 —— 而且不是在什么边缘问题上凑数,是在一个困扰了数学界 80 年的经典问题上,找到了一个没有人想到的反例(参见《 AI首次证明数学核心猜想:80年的经典难题,被OpenAI搞定了 》)。 几周之内,人类数学家基于 AI 的思路做出了进一步改进。几天之内,相关技术就被用来解决其他重要问题。 8 月 1 日,OpenAI 又宣布:他们一个叫 Astra 的模型,一口气拿下了 10 项数学进展,其中包括 Erdős 提出的另外三个问题的解答(参见《 OpenAI刚曝光的下一代Astra,拿下10项开放问题新突破,成本仅2000美元 》)。 普林斯顿大学的 Noga Alon—— 一个在几十年职业生涯中亲手解决过几十个 Erdős 问题的数学家 —— 说,这些模型「正在极大地改变数学研究的方式。」 如果你不熟悉 Erdős 是谁,这一切听起来可能只是「AI 又赢了一次」。但 为什么偏偏是他的问题,成了全球最强 AI 公司的核心竞技场 ?要理解这件事,得先从 Erdős 这个人说起。 (注:本文改写自《量子杂志》,文末附原文链接) 一个拎着手提箱的怪人 Paul Erdős 是历史上最多产的数学家之一。他一生发表了超过 1500 篇论文,和 500 多位合作者一起工作过。 但他最特别的不是数量,而是生活方式。 他没有固定住所,没有固定工作,几乎一无所有。他拎着一只手提箱,在朋友家里蹭住,从一个大学漂到另一个大学,走到哪算哪。他把大部分收入捐了出去,财务由一位朋友帮忙打理。 他只穿丝绸。他避免和人身体接触。他对权威深感不信任,把上帝称为「最高法西斯」(Supreme Fascist)。他用持续的安非他命摄入来驱动自己源源不断的数学产出。 他还有个习惯:到处抛出数学问题。在论文里、在信里、在闲聊中,他会随手写下一个问题,然后在旁边标注一个金额 ——10 美元、25 美元,有时候几千美元。第一个解决问题的人可以拿到这笔钱。他自掏腰包。 1996 年,Erdős 在华沙参加一个数学会议时因心脏病发作去世。但他的问题没有死。爱荷华州的一个非营利基金会承诺继续兑现他的悬赏。 而现在,这些问题的解决方案,正在以另一种货币来计价 —— 每个问题消耗多少 token 。 一个反权威的流浪者留下的遗产,成了世界上最强大的科技公司的公关武器。 一个网站,意外成了 AI 的试验场 如果没有一个叫 Thomas Bloom 的英国数学家,这一切可能不会发生。 Bloom 在曼彻斯特大学,研究算术组合学。他从小就喜欢 Erdős 的风格,但一直有个烦恼:Erdős 的问题散落在各处,哪些被解决了、哪些还悬着,根本搞不清楚。 2023 年初,他决定把这些问题尽可能收集到一个列表里。本来是自己用,但他觉得如果随时随地都能访问会更方便,于是他做了一个网站 ——erdosproblems.com。 有意思的是,他写这个网站的 Python 代码,用的是 ChatGPT。那时候,大语言模型能帮他写个网站已经挺了不起了。至于用它来做数学?那还是遥远的事。 Bloom 不光收集问题。Erdős 有时候表述问题的方式含糊不清,Bloom 会仔细找出每个问题最合理的版本。他不断添加,受众逐渐增长。到 2025 年 8 月,他已经编目了近 1000 个问题。 然后他做了一件小事: 加了评论区 。自此,一个社区真正被建立起来了。 客服小哥和菲尔兹奖得主 评论区里发生的事情,堪称互联网普世价值的最佳典范。 不管你有没有终身教职,不管你在不在顶尖大学,甚至不管你是不是数学家 —— 只要你有好想法,你就能找到人合作。 Wouter van Doorn 是网站上第四活跃的评论者。他的正式工作,用他自己的话说,是「为一家被其他公司雇佣来做客户服务支持的公司」工作。但他也不是纯业余 —— 十年前,他差点在比利时鲁汶大学完成数学硕士。 2024 年,看到大语言模型的能力飞速增长,他请了六个月假,专注做数学。他当时的想法是:「现在我仍然比 AI 更擅长数学,但谁知道一年后、两年后、五年后会怎样?如果我想完成这些项目,现在就是时候了。」 2025 年 10 月,van Doorn 在 Erdős 问题 1102 的页面下留了第一条评论。11 月初,他不依赖 AI,找到了一些进展,分享在了评论区。 当天晚些时候,有人回复说他在论证中发现了一个缺陷。两人迅速交锋,van Doorn 说服了对方。 「我现在明白你的论证了。漂亮!」那位数学家回复道。 那位数学家叫陶哲轩,加州大学洛杉矶分校教授。陶哲轩和 Erdős 的缘分可以追溯到他还是个 10 岁小孩的时候 —— 那时候他见过 Erdős 本人。2015 年,他 Polymath5 项目合作者一起解决了 Erdős 偏差问题(Erdős Discrepancy Problem),「赢」走了 500 美元奖金。 Erdős 正在给年幼的陶哲轩讲解数学问题 。 圣诞节的乌龙 2025 年夏天,Kevin Barreto 和 Liam Price 在一个 AI 爱好者 Discord 服务器上成了朋友。Barreto 在剑桥读本科,Price 学过一些数学但没读完就离开了。 12 月,他们确信最新的 AI 模型能搞定一些 Erdős 问题,于是开始成批地把问题喂给模型。 他们很快发现了一个窍门:如果你直接告诉 GPT-5.2「这个问题还没人解出来」,它就没什么进展。但如果你换个说法 —— 让它以为问题比实际更容易 —— 效果就好得多。 圣诞节早上,Barreto 在网站上发了一个证明,宣称这是「LLM 完全自主解决 Erdős 问题的首个案例」。 几个小时后,有人指出:Erdős 本人在 1977 年的一篇论文里就已经给过答案了。 Barreto 很坦率地认了错,然后写了句话:「我正式请求网站所有成员更加重视对目前标记为未解问题的文献检索。作为一个已经两次犯过这种错误的人,这相当令人沮丧。」 但他们没放弃。2026 年 1 月 4 日,他们用 GPT-5.2 Pro 解决了另一个问题(Erdős 728),这次确实没人能找到已有的证明。Barreto 还用了另一个叫 Aristotle 的 AI 工具来验证逻辑成立。 Price 摸索出了一套方法论:先让 AI 给一个解法,然后把解法喂给一个新的 AI 实例让它检查,反复迭代,直到得到看起来可行的方案。这其实就是很多公司在内部做的事情 —— 他们管这叫 harness 或 scaffold,只不过 Price 是手工完成的。 一个无法回避的问题 这里有个微妙的问题。 按 Price 自己的评估,他没有足够的数学功底来验证 AI 给出的最终解法是否正确。他需要找真正懂行的人来把关。 在 Barreto 的帮助下,他们找到了。Price 和 Barrett 最终成为了陶哲轩、斯坦福的 Jared Duker Lichtman 等人 2
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱