智能AI
morning
加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!
摘要
新智元报道 100 个电子的量子行为,用暴力方法计算一次所需的时间超过宇宙的年龄。 一颗药物分子动辄上千个电子,一块电池材料更多。模拟它们,是药物、电池、芯片研发的底层需求。 加州理工学院 Anima Anandkumar 团队 8 月 24 日发了一篇论文,用一个 AI 模型把这类计算的复杂度从立方级压到了近线性级。 https://x.com/AnimaAnandkumar/status/20...
FNO
GPU
https
com
Kohn
Sham
Anandkumar
AnimaAnandkumar
status
7800
2026-08-27
1 阅读
约7分钟阅读
新智元
字号:
新智元报道 100 个电子的量子行为,用暴力方法计算一次所需的时间超过宇宙的年龄。 一颗药物分子动辄上千个电子,一块电池材料更多。模拟它们,是药物、电池、芯片研发的底层需求。 加州理工学院 Anima Anandkumar 团队 8 月 24 日发了一篇论文,用一个 AI 模型把这类计算的复杂度从立方级压到了近线性级。 https://x.com/AnimaAnandkumar/status/2092031815448248594 效果相当震撼:在单块 GPU 上完成了一个含 82500 个电子的金属缺陷模拟,2019 年同类计算用了约 7800 块 GPU。 困了 60 年的瓶颈 量子化学领域最常用的计算方法叫密度泛函理论(DFT),诺贝尔奖级的理论,药物筛选、催化剂设计、电池材料研发都离不开它。 问题在于太慢:体系每大一点,计算量就呈立方增长——电子数翻 10 倍,计算量涨 1000 倍。 60 年来,物理学家一直在找让它提速的办法,但没有实质突破。 AI 尝试过两种思路。 一种思路是让模型直接预测最终结果,一步到位。 训练分布内效果不错,但外推能力很差:分子一旦大于训练集中见过的,误差就失控。 论文实测,从小分子外推到药物级分子时,直接预测模型的误差从不到 1% 飙到约 10%,最高达 41%。 另一种思路沿用物理学家的老路,让 AI 学一个逆向映射。 这条路数学上不稳定,论文的对照实验中,所有计算都在迭代几步后发散,全军覆没。 像思维链一样迭代 而不是一步猜答案 这篇论文换了一个方向。 DFT 的计算流程是一个反复迭代的过程:每轮给定一组输入条件,算出电子密度,再用密度更新输入条件,循环往复直到结果稳定。 传统方法卡在每轮迭代中都要做一次计算量巨大的求解,这一步是立方级的。 Anandkumar 团队的做法是:用 AI 替掉这一步。 训练一个傅里叶神经算子(FNO),让它学会「给定输入条件,输出对应的电子密度」这个正向映射,计算复杂度从 O(N³) 降到 O(N log N)。 然后把模型嵌回原来的迭代循环,其他步骤照旧。 https://x.com/AnimaAnandkumar/status/2090125110309204371 可以这样理解:直接预测模型相当于让 LLM 对一道难题一步给出最终答案,简单题没问题,难题容易错。 Kohn-Sham FNO 相当于让模型做推理时的思维链,分步推演,每一步都能自我校验,错了后续迭代会把它拉回来。 这种设计还自带一个直接预测模型没有的优势:安全阀。 如果模型被推到了能力范围之外,迭代会发散,研究者立刻知道结果不可信。 论文中镁位错实验的第一次尝试就验证了这一点:用通用预训练模型直接算,所有计算立即发散——发散本身就是警报。 直接预测模型给出一个答案,你无从判断它是对是错。 训练数据只用了 8504 个结构,一个模型同时处理分子和固体材料,覆盖元素周期表前五行。 这得益于团队设计的一种域不变 FNO 变体:不同大小的体系共享同一套学到的滤波器,小分子和大块晶体用同一个模型。 外推到训练集没见过的药物级大分子时,Kohn-Sham FNO 的密度误差为 2.23%,直接预测模型为 9.97%。 分子越大差距越明显:到 45 个重原子时,直接预测误差飙到 41%,Kohn-Sham FNO 只有 4%。 1 块 GPU,8 万个电子 团队拿镁的位错结构做了大规模验证。 2019 年,一项获得 ACM 戈登贝尔奖提名的研究对 6164 个镁原子做了全量 DFT 计算,动用了 Summit 超算上约 7800 块 NVIDIA V100 GPU。 而最新的 Kohn-Sham FNO 在单块 NVIDIA B300 GPU 上完成了 8250 个原子、82500 个价电子的计算,全部收敛。 实测缩放指数为 1.03 (接近完美线性) ,传统方法为 3.37 (立方级) 。 1 块 B300 与 7800 块 V100 不是硬件对等比较,但缩放指数不受硬件影响:一个近线性,一个立方,体系越大差距越不可逆。 论文发布同一天,Anandkumar 宣布创办 AI 物理模拟公司 Accelerated Understanding,路透社随后做了报道。 https://www.reuters.com/business/ai-founders-who-walked-away-bezos-backed-prometheus-model-universe-2026-08-25/ 据她在 X 上介绍,公司训练的 AI 模型在 4D 空间中模拟物理现象,推理上下文长度超过 5 万亿。 https://x.com/AnimaAnandkumar/status/2092236528898675014 目前 Kohn-Sham FNO 只学了计算流程中的一个环节,完整的能量计算还需要一步后处理。 但路径已经清楚:AI 替代的不是物理,是物理计算中最烧钱的那一步重复运算。 团队下一步计划补上剩余环节,届时后处理也可以省掉。未来可期。 团队创始人合照 参考资料: https://tensorlab.cms.caltech.edu/users/anima/ks_fno.html 编辑:马可 秒追ASI ⭐ 点赞、转发、在看一键三连 ⭐ 点亮星标,锁定新智元极速推送! 文章原文
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱