智能AI
morning
AI不是比人聪明,是输得起!菲尔兹奖得主点破OpenAI十项成果
摘要
新智元报道 AI解决了数学界一个悬了80年的老问题:埃尔德什平面单位距离猜想。 5月的一个下午,这个消息第一次传到Timothy Gowers耳中时,他以为AI给出的是一个证明。 如果这是真的,「数学家可能很快就要出局了。」 他花了整整一晚上,重新调整自己的世界观。 第二天早上,一封澄清邮件到了:AI不是证明了这个猜想,是推翻了它。 Gowers反倒「松了一口气」。 为什么AI找到了一个反例,比它...
Fournier
压根不是两种能力
新智元报道
AI解决了数学界一个悬了80年的老问题
埃尔德什平面单位距离猜想
5月的一个下午
这个消息第一次传到Timothy
Gowers耳中时
他以为AI给出的是一个证明
如果这是真的
2026-08-18
1 阅读
约10分钟阅读
新智元
字号:
新智元报道 AI解决了数学界一个悬了80年的老问题:埃尔德什平面单位距离猜想。 5月的一个下午,这个消息第一次传到Timothy Gowers耳中时,他以为AI给出的是一个证明。 如果这是真的,「数学家可能很快就要出局了。」 他花了整整一晚上,重新调整自己的世界观。 第二天早上,一封澄清邮件到了:AI不是证明了这个猜想,是推翻了它。 Gowers反倒「松了一口气」。 为什么AI找到了一个反例,比它证出了 一个定理,更让 Gowers觉得安心? 8月12日,他的一篇博客给出了答案。 一切要从 8月1日说起。 那天,OpenAI一口气甩出十项数学与理论计算机科学成果。 用官方的话说:其中每一项都解决了一个长期悬而未决的问题,或在相关问题上取得了实质性进展。 这些成果来自OpenAI尚未发布的内部版模型Astra。 那几天,社交媒体上只剩下一种反应:这回真的不一样了。 用Simon Willison的话说,网上的数学家们在集体经历一次「深蓝时刻」。 更早几天,数学家Kirwin Hampshire已经写了一篇《数学的黑暗之夜》。当时触发他的还只是此前那些分量更轻的结果,他形容自己陷入了一场深刻的精神危机。 Gowers先承认这十项结果极其惊人,然后抛出一个问题: 如果大模型在数学的所有方面都已经强过所有人类,凭它们的速度优势,成果本该像洪水一样涌出来。 洪水为什么没来? 两位数学家 接着这批成果写出两篇论文 这11天里,紧跟着OpenAI这十项成果,arXiv上出现了两篇论文。 8月3日,剑桥的群论学者Francesco Fournier-Facio先挂出一篇。 他把OpenAI证明里最要紧的那个判据拿走,绕开原来用到的Leavitt代数,另起炉灶,造出一个原方法造不出来的版本:一个无挠的非sofic群。 8月11日,Raphael Steiner又把OpenAI那套多色Ramsey数的递归构造改了改,推广到所有固定的奇圈。 有人能够接着Astra的研究成果往下写论文,说明它给出的是一套能长东西的方法。 Fournier-Facio还说,Kun–Thom那个结果可以往前推的方向有无数条,其中大量根本不成立,还有大量就算成立也派不上用场。 OpenAI挑中的这一条,熟悉这块领域的专家多半都证得出来。难的是在无数条里,想到该去试它。 Fournier-Facio在论文里判断,OpenAI的新意在于写下了那个命题,而不在证明技巧。 他 给出了一个形象的比喻: AI不受时间和资源的限制,所以它可以不停往墙上扔东西,看哪个粘得住。 反例和定理 压根不是两种能力 在数学家的直觉里,找反例是运气活。 你只要凑出一个特例,把猜想打穿一个洞,命题就倒了。证定理是硬功夫,得保证一个例外都没有,还要有那种想很久才会灵光一现的洞见。 所以AI擅长找反例,可以接受。AI擅长证定理,才真正叫改朝换代。 但Gowers想说的是,这条界线根本立不住。找反例和证定理,压根不是两种能力。 他先承认,AI目前最有分量的成果确实集中在反例上。 单位距离猜想、Jacobian猜想、非sofic群、多色Ramsey数,看上去全是。 但大模型同样能证明困难的普遍命题,只是那些定理还没达到这批反例的分量。 然后,他摆了两个结果。 维诺格拉多夫1937年证明:足够大的整数都能写成三个素数之和。 格卢斯金1981年证明:任意维度下,都存在两个「形状」相差极远的空间。 把这两句话翻成数学家写论文的格式,骨架几乎一模一样,可没人会说维诺格拉多夫找到了一个反例,也没人会说格卢斯金证明了一个定理。 区别在于难的那一步落点在哪。 维诺格拉多夫的全部功夫,在于让三个素数正好凑出指定的那个数。格卢斯金那边,要造出两个指定维数的空间一点都不难,难的是让它们离得足够远。 同样的骨架,难点不同,一个就成了定理,另一个就成了例子。 还有更微妙的一层。「反例」这个词里带着心理成分。只有推翻了大家原本有理由相信的命题,才配叫反例。 非sofic群不算。按Gowers和Fournier-Facio的说法,文献里早就有若干种构造思路,本来就没多少专家真的相信所有群都是sofic的。因此,更准确地说,是OpenAI给出了第一个非sofic群的实例。 多色Ramsey那项,Gowers更有发言权。他年轻时研究过它的一个等价形式,当年下功夫的方向,正是后来被证明走对了的那个方向。对他本人来说,那是一个符合预期的例子,不是反例。 同一个结果,在原本相信猜想的人那里是反例,在他这里只是一个例子。 这说明界线跟着人走,而不是跟着数学走。 既然反例和定理分不开,AI在数学上的强弱,就不能按命题类型来划。 那该按什么划分? 八种找例子的方法 AI只擅长其中四种 分野不在命题类型,在怎么搜。 Gowers把数学家找例子的常规打法列了八种: 翻出手头的标准例子挨个试 拿基本例子拼装 先留白后补条件 反过来证它不可能存在 一次次修正上一版的猜测 按条件一段一段搭出来 随机抽一个 取一个足够一般的例子 他判断,大模型在其中四种上会很强:翻现成例子、一步一步搭、随机抽、取一般性例子。 这四种的共同点是套路成熟、训练数据里实例密集、失败成本低。模型只要肯一个一个试,总能撞上一个。 另外三种不一样。先留白后补条件、反过来证它不可能、一次次修正上一版的猜测,这三种都要求你在半路上反复判断同一件事:我现在走的这条路,还值不值得走下去。 Gowers的解释不难理解。 大模型有两项确定无疑的优势:一是知识面宽到几乎覆盖全部标准论证;二是快,可以在找到解之前失败无数次。 这两项加起来,是一种和人类完全不同的风格:问题的运气成分越重,它越占上风。 人类还守得住的地盘,是那种岔路特别多、又特别深的问题。 数学家管这个叫搜索树。 每往下走一步,脚下就再分出十几条岔路,越往下越宽。你不可能条条都走,得在半路上判断哪几条根本不用去,直接砍掉。 这个动作叫剪枝。如果不剪,光靠算力,走到天亮也走不到底。 一个佐证来自专家们的集体反应。 Gowers注意到,大家的说法高度一致:一开始震惊于这题居然被解决了,仔细一看发现方法其实没那么新,一个合适的专家得到一点提示,本来也能找到。 这不是在贬低AI的发现,是给了它一个更准的画像: 它的优势不在于比人聪明,在于它「输得起」。 同一道题,人只够试几条路,它可以把几百条都试一遍。 大模型为什么长不出这份嗅觉? 第一个理由,训练数据里根本没有这门课。 公开发表的证明全是「干净的成品」:发现者试过哪些方向、在第几步觉得不对、为什么掉头,统统被抹掉了。 模型看到的是结论,看不到过程。 其实人类也没人教过。区别在于,数学家是在自己卡壳、走错、掉头的过程里练出这身本事的,模型只能从别人整理好的成品里学。 第二个理由更反直觉:快,本身就是阻力。 人类必须狠剪,因为一辈子只够走几条路。 大模型有速度也有知识面,扛得住人类完全扛不起的低效搜索。既然不缺,就没有非剪不可的压力。 Gowers直言:大模型今天的成功,也许用的正是人类看来极其低效的方法,只是岔路还没多到把它压垮。 第三,这事儿很难做实验。一个看起来只能来自深思的想法,也可能只是从文献里调出了某位人类数学家的深思。 Gowers自己的使用体感也
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱