加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!

新智元 2026-08-26 15:20

加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图1

  新智元报道  

加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图2


100 个电子的量子行为,用暴力方法计算一次所需的时间超过宇宙的年龄。


一颗药物分子动辄上千个电子,一块电池材料更多。模拟它们,是药物、电池、芯片研发的底层需求。


加州理工学院 Anima Anandkumar 团队 8 月 24 日发了一篇论文,用一个 AI 模型把这类计算的复杂度从立方级压到了近线性级。


加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图3

https://x.com/AnimaAnandkumar/status/2092031815448248594


效果相当震撼:在单块 GPU 上完成了一个含 82500 个电子的金属缺陷模拟,2019 年同类计算用了约 7800 块 GPU。



加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图4
困了 60 年的瓶颈


量子化学领域最常用的计算方法叫密度泛函理论(DFT),诺贝尔奖级的理论,药物筛选、催化剂设计、电池材料研发都离不开它。


问题在于太慢:体系每大一点,计算量就呈立方增长——电子数翻 10 倍,计算量涨 1000 倍。


60 年来,物理学家一直在找让它提速的办法,但没有实质突破。


AI 尝试过两种思路。


一种思路是让模型直接预测最终结果,一步到位。


训练分布内效果不错,但外推能力很差:分子一旦大于训练集中见过的,误差就失控。


论文实测,从小分子外推到药物级分子时,直接预测模型的误差从不到 1% 飙到约 10%,最高达 41%。


另一种思路沿用物理学家的老路,让 AI 学一个逆向映射。


这条路数学上不稳定,论文的对照实验中,所有计算都在迭代几步后发散,全军覆没。


加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图5



加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图6
像思维链一样迭代
而不是一步猜答案


这篇论文换了一个方向。


DFT 的计算流程是一个反复迭代的过程:每轮给定一组输入条件,算出电子密度,再用密度更新输入条件,循环往复直到结果稳定。


传统方法卡在每轮迭代中都要做一次计算量巨大的求解,这一步是立方级的。


Anandkumar 团队的做法是:用 AI 替掉这一步。


训练一个傅里叶神经算子(FNO),让它学会「给定输入条件,输出对应的电子密度」这个正向映射,计算复杂度从 O(N³) 降到 O(N log N)。


然后把模型嵌回原来的迭代循环,其他步骤照旧。


加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图7

https://x.com/AnimaAnandkumar/status/2090125110309204371


可以这样理解:直接预测模型相当于让 LLM 对一道难题一步给出最终答案,简单题没问题,难题容易错。


Kohn-Sham FNO 相当于让模型做推理时的思维链,分步推演,每一步都能自我校验,错了后续迭代会把它拉回来。


这种设计还自带一个直接预测模型没有的优势:安全阀。


如果模型被推到了能力范围之外,迭代会发散,研究者立刻知道结果不可信。


论文中镁位错实验的第一次尝试就验证了这一点:用通用预训练模型直接算,所有计算立即发散——发散本身就是警报。


直接预测模型给出一个答案,你无从判断它是对是错。


训练数据只用了 8504 个结构,一个模型同时处理分子和固体材料,覆盖元素周期表前五行。


这得益于团队设计的一种域不变 FNO 变体:不同大小的体系共享同一套学到的滤波器,小分子和大块晶体用同一个模型。


外推到训练集没见过的药物级大分子时,Kohn-Sham FNO 的密度误差为 2.23%,直接预测模型为 9.97%。


分子越大差距越明显:到 45 个重原子时,直接预测误差飙到 41%,Kohn-Sham FNO 只有 4%。



加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图8
1 块 GPU,8 万个电子


团队拿镁的位错结构做了大规模验证。


2019 年,一项获得 ACM 戈登贝尔奖提名的研究对 6164 个镁原子做了全量 DFT 计算,动用了 Summit 超算上约 7800 块 NVIDIA V100 GPU。


而最新的 Kohn-Sham FNO 在单块 NVIDIA B300 GPU 上完成了 8250 个原子、82500 个价电子的计算,全部收敛。


实测缩放指数为 1.03(接近完美线性),传统方法为 3.37(立方级)


1 块 B300 与 7800 块 V100 不是硬件对等比较,但缩放指数不受硬件影响:一个近线性,一个立方,体系越大差距越不可逆。


论文发布同一天,Anandkumar 宣布创办 AI 物理模拟公司 Accelerated Understanding,路透社随后做了报道。


加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图9

https://www.reuters.com/business/ai-founders-who-walked-away-bezos-backed-prometheus-model-universe-2026-08-25/


据她在 X 上介绍,公司训练的 AI 模型在 4D 空间中模拟物理现象,推理上下文长度超过 5 万亿。


加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图10

https://x.com/AnimaAnandkumar/status/2092236528898675014


目前 Kohn-Sham FNO 只学了计算流程中的一个环节,完整的能量计算还需要一步后处理。


但路径已经清楚:AI 替代的不是物理,是物理计算中最烧钱的那一步重复运算。


团队下一步计划补上剩余环节,届时后处理也可以省掉。未来可期。


加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图11

团队创始人合照


参考资料:

https://tensorlab.cms.caltech.edu/users/anima/ks_fno.html

编辑:马可


秒追ASI
点赞、转发、在看一键三连
点亮星标,锁定新智元极速推送!

加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图12
加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!图13

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI
more
IDAS2026 分论坛预告 | 半导体 AI 技术及应用论坛(一)—— AI 驱动设计‑EDA 协同
预见AI+医药注册合规新未来 | 创思立信专场论坛燃爆第二届CMAC政策法规与监管科学年会
前剪映负责人入局AI设计:拿近亿天使轮,让「特朗普」给你打工
苹果两款Mac主机上新:2nm制程首发 为端侧AI筑牢硬件底座
OpenAI 自研「辣椒芯片」首测超英伟达,会让 ChatGPT 更便宜吗?
腾讯汤道生长文:AI下半场,熬得久比起得早更重要
广州计量院举办 “AI+NQI” 专题讲座 以人工智能赋能质量基础设施建设
SpaceXAI 采用 NVIDIA Vera CPU,大规模加速智能体 AI 发展
物理AI遭遇“GPT-2时刻”:宇树科技市值腰斩背后的数据危机与路线之争
涨幅逾15%?英伟达或调涨AI服务器价格
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号