突发!OpenAI官宣24天攻破100+世界级数学难题

关注
数学,只是先到了而已。

编者按:本文来自微信公众号 新智元(ID:AI_era),编辑:马可 桃子 摩西,创业邦经授权转载。

数学界,真被AI追到家门口了!

就在刚刚,OpenAI突然甩出一篇重磅博文——

一款8月28日才开始训练的内部新模型,现已攻克了100多道世界级数学难题。

图片

横跨的,还是数学大部分领域。

更夸张的是,这100多道题中,还包括此前困扰数学界多年的「纳维–斯托克斯」千禧年难题。

这进化速度,快到让OpenAI内部数学家感到意外。

从8月28日开训,到9月21日官宣,仅仅24天。

图片

一款还在训练中的内部AI,开始横扫人类几十年,甚至是上百年没有解决的问题。

就在今天,OpenAI请来了9位全球顶尖数学家,正式成立一个独立的数学顾问组。

名单中有,菲尔兹奖得主Timothy Gowers、Martin Hairer,还有理论物理和数学界大神Edward Witten。

图片

这阵容,堪称数学界「复仇者联盟」。

他们接下来要面对的是,AI开始批量「爆破」数学难题,人类数学界,到底该怎么接?

OpenAI开训不到一周,AI攻克千禧年难题

在数学界,难题之间也是有鄙视链的。

要看懂这次进展的含金量,还得先把进度条拉回到9月8日。

OpenAI一款全新内部模型,在短短88小时内攻克了NS千禧年难题。

它给出了NS方程存在性与光滑性问题的证明,并同步公开166页论文和Lean形式化验证代码。

图片

拓展阅读:OpenAI官宣:88小时攻破千禧年难题!

按照公司的介绍,该结果表明:

在光滑外力作用下,初始静止、光滑的三维不可压缩流体,可以在有限时间内形成奇点,对应千禧年大奖难题官方表述中的C、D版本。

这份证明背后,是一次大规模、1万多个并发Agent协同研究。

它们可以读取互联网缓存、运行代码,在组内交换信息,不同小组则探索不同的问题版本与解题路线。

研究人员也持续参与其中:在系统先取得欧拉方程相关成果后,他们把资源向纳维–斯托克斯问题集中,以已有解法引导后续探索;再通过Codex汇总各组有价值的中间见解,让不同路线之间发生交流。

9月5日,距离首批智能体启动约88小时,系统得出解法。

图片

随后,GPT‑6 Astra又花了17小时完成Lean形式化与验证。

模型、工具、并行探索,以及人的研究组织,共同构成了这次攻坚过程。

而到了今天,OpenAI披露的成果范围进一步扩大:在纳维–斯托克斯之外,还有百余道长期开放难题,横跨数学大部分领域。

OpenAI表示,这种进展已经引发内部讨论——怎样让数学共同体及时了解变化,为准备和适应留出空间。

这也让「怎样审查、怎样发布」成为一个紧随能力进展而来的现实问题。

图片

27位菲尔兹奖得主联名炮轰AI毁掉数学

就在OpenAI宣布NS方程突破的三天后,数学界直接炸了。

27位菲尔兹奖得主重磅联名,发表了一封火药味极浓的公开信——《AI在数学领域的严重错位》。


签名的大佬,横跨了48年的菲尔兹奖历史。

邓煜、陶哲轩、许埈珥、吴宝珠、彼得·舒尔茨(Peter Scholze)、马丁·海雷尔(Martin Hairer).......

数学界最高荣誉的获奖者,几乎集体站了出来。

图片

图片

他们的愤怒不是针对AI本身。公开信开篇明确承认,AI有加速真正数学研究的巨大潜力。

真正让数学大佬无法接受的,是公布的方式。

他们批评道,各大AI巨头把人类几百年沉淀下来的公开数学难题,当成跑分刷榜的benchmark。

解题这项指标,与数学研究所追求的理解,可能发生偏离。

而且,巨头仓促公布之后,根本没有时间对思路进行梳理,以及新方法的充分撰写。

这种功利化、黑箱化的暴力破解,看似风光,实则给数学界留下一地鸡毛。

当然,OpenAI也没有回避,在最新公告中,他们直接引用了这篇文章,公开表示——

AI巨头和数学家之间,必须坐下来好好聊聊了。

图片

因此,「数学界复仇者联盟」才是真正的重头戏。

9位泰斗组团盯AI,数学界复仇者联盟集结

这支独立顾问组的首批成员,一共有9个人。

他们分别来自剑桥、牛津、哈佛、斯坦福、伯克利、普林斯顿高等研究院等机构。

随便拎几个名字出来,都足够吓人。

Timothy Gowers,密切关注AI数学进展的菲尔兹奖得主。Martin Hairer,2014年菲尔兹奖得主。

Camillo De Lellis,普林斯顿高等研究院教授,恰恰是偏微方程与流利力学数学理论的世界级权威。

Edward Witten更不用说了,理论物理当代最强宗师,被称为「爱因斯坦的后继者」,也是首位获得菲尔兹奖的物理学家。

图片

OpenAI给这支队伍的任务,主要有三件:

  • 帮忙判断新数学成果到底有多重要;
  • 讨论这些结果该怎么发布、什么时候发布;
  • 确保AI时代的数学研究,依然遵守学术和职业规范。

还有一个很有意思的设计,这9个人不拿OpenAI一分钱。他们可以公开批评OpenAI,可以提出公司未要求的建议,可以自行决定成员变更。

但有一个关键限制,顾问组不负责建议OpenAI如何控制内部数学研究的进度。

9位学术泰斗有公开发言权,但没有「刹车权」。

图片

AI解得出,但人类审得完吗?

一切已经极其明朗。

开训不到一个月,刷爆100多道历史难题。在这个恐怖的速度面前,技术的瓶颈早就不在于「AI解不解得出」,而变成了「人类审不审得完」。

审AI的论文是什么滋味?Buckmaster的感触最深——

那份大模型生成的初步证明,是他读过最可怕的东西。他们后来为了抢首发而赶出来的论文,被他自己鄙视为一滩「AI Slop(人工智能泔水)」,并为此公开道歉。

打磨了一年的人类精英尚且被压制得如此狼狈,现在机器一个月直接往脸上吐100多道大题。全世界能审纳维-斯托克斯级别证明的人,两只手数得过来。

所以,这支「九人顾问天团」的真实功能是什么?

图片

说白了,就是OpenAI给这堆机器产物找的一条顶级流水线兼排雷组。

哪道题值得先看?哪道要拆开重写?找谁来核对?署谁的名字?OpenAI把这些脏活累活全丢给了9个不拿工资的大神,而把疯狂刷题的引擎油门,死死攥在了自己手里。

数学界自己也意识到了这场海啸。

多伦多大学数论学家Daniel Litt这几天在X上透露,他跟各系系主任聊完的共识是:激励机制、招聘规范和博士评价方式必须彻底重构。大家已经准备好保卫数学文化,决不再鼓励「单纯生产PDF」。

菲尔兹奖得主Figalli更是预言,数学家的角色,正在从「解题的人」被迫变成「判断哪些题值得解的人」。

图片

图片

如今,OpenAI毫不掩饰地确立了新世界的潜规则:发现归机器,验收和解释归人类。

物理、化学、生物迟早也会走到这一步,每一门学科都会有这么一天。

数学,只是先到了而已。

参考资料:

https://openai.com/index/advisory-group-on-mathematics-and-ai/https://agmai.org/https://mathandai.org/multilingual.php?lang=zhhttps://openai.com/zh-Hans-CN/index/navier-stokes-solution/

本文为专栏作者授权创业邦发表,版权归原作者所有。文章系作者个人观点,不代表创业邦立场,转载请联系原作者。如有任何疑问,请联系editor@cyzone.cn。

反馈
联系我们
推荐订阅