
数学界,真被AI追到家门口了!
就在刚刚,OpenAI突然甩出一篇重磅博文——
一款8月28日才开始训练的内部新模型,现已攻克了100多道世界级数学难题。

横跨的,还是数学大部分领域。
更夸张的是,这100多道题中,还包括此前困扰数学界多年的「纳维–斯托克斯」千禧年难题。
这进化速度,快到让OpenAI内部数学家感到意外。
从8月28日开训,到9月21日官宣,仅仅24天。

一款还在训练中的内部AI,开始横扫人类几十年,甚至是上百年没有解决的问题。
就在今天,OpenAI请来了9位全球顶尖数学家,正式成立一个独立的数学顾问组。
名单中有,菲尔兹奖得主Timothy Gowers、Martin Hairer,还有理论物理和数学界大神Edward Witten。

这阵容,堪称数学界「复仇者联盟」。
他们接下来要面对的是,AI开始批量「爆破」数学难题,人类数学界,到底该怎么接?
在数学界,难题之间也是有鄙视链的。
要看懂这次进展的含金量,还得先把进度条拉回到9月8日。
OpenAI一款全新内部模型,在短短88小时内攻克了NS千禧年难题。
它给出了NS方程存在性与光滑性问题的证明,并同步公开166页论文和Lean形式化验证代码。

按照公司的介绍,该结果表明:
在光滑外力作用下,初始静止、光滑的三维不可压缩流体,可以在有限时间内形成奇点,对应千禧年大奖难题官方表述中的C、D版本。
这份证明背后,是一次大规模、1万多个并发Agent协同研究。
它们可以读取互联网缓存、运行代码,在组内交换信息,不同小组则探索不同的问题版本与解题路线。
研究人员也持续参与其中:在系统先取得欧拉方程相关成果后,他们把资源向纳维–斯托克斯问题集中,以已有解法引导后续探索;再通过Codex汇总各组有价值的中间见解,让不同路线之间发生交流。
9月5日,距离首批智能体启动约88小时,系统得出解法。

随后,GPT‑6 Astra又花了17小时完成Lean形式化与验证。
模型、工具、并行探索,以及人的研究组织,共同构成了这次攻坚过程。
而到了今天,OpenAI披露的成果范围进一步扩大:在纳维–斯托克斯之外,还有百余道长期开放难题,横跨数学大部分领域。
OpenAI表示,这种进展已经引发内部讨论——怎样让数学共同体及时了解变化,为准备和适应留出空间。
这也让「怎样审查、怎样发布」成为一个紧随能力进展而来的现实问题。

就在OpenAI宣布NS方程突破的三天后,数学界直接炸了。
27位菲尔兹奖得主重磅联名,发表了一封火药味极浓的公开信——《AI在数学领域的严重错位》。
签名的大佬,横跨了48年的菲尔兹奖历史。
邓煜、陶哲轩、许埈珥、吴宝珠、彼得·舒尔茨(Peter Scholze)、马丁·海雷尔(Martin Hairer).......
数学界最高荣誉的获奖者,几乎集体站了出来。


他们的愤怒不是针对AI本身。公开信开篇明确承认,AI有加速真正数学研究的巨大潜力。
真正让数学大佬无法接受的,是公布的方式。
他们批评道,各大AI巨头把人类几百年沉淀下来的公开数学难题,当成跑分刷榜的benchmark。
解题这项指标,与数学研究所追求的理解,可能发生偏离。
而且,巨头仓促公布之后,根本没有时间对思路进行梳理,以及新方法的充分撰写。
这种功利化、黑箱化的暴力破解,看似风光,实则给数学界留下一地鸡毛。
当然,OpenAI也没有回避,在最新公告中,他们直接引用了这篇文章,公开表示——
AI巨头和数学家之间,必须坐下来好好聊聊了。

因此,「数学界复仇者联盟」才是真正的重头戏。
这支独立顾问组的首批成员,一共有9个人。
他们分别来自剑桥、牛津、哈佛、斯坦福、伯克利、普林斯顿高等研究院等机构。
随便拎几个名字出来,都足够吓人。
Timothy Gowers,密切关注AI数学进展的菲尔兹奖得主。Martin Hairer,2014年菲尔兹奖得主。
Camillo De Lellis,普林斯顿高等研究院教授,恰恰是偏微方程与流利力学数学理论的世界级权威。
Edward Witten更不用说了,理论物理当代最强宗师,被称为「爱因斯坦的后继者」,也是首位获得菲尔兹奖的物理学家。

OpenAI给这支队伍的任务,主要有三件:
帮忙判断新数学成果到底有多重要;
讨论这些结果该怎么发布、什么时候发布;
确保AI时代的数学研究,依然遵守学术和职业规范。
还有一个很有意思的设计,这9个人不拿OpenAI一分钱。他们可以公开批评OpenAI,可以提出公司未要求的建议,可以自行决定成员变更。
但有一个关键限制,顾问组不负责建议OpenAI如何控制内部数学研究的进度。
9位学术泰斗有公开发言权,但没有「刹车权」。

一切已经极其明朗。
开训不到一个月,刷爆100多道历史难题。在这个恐怖的速度面前,技术的瓶颈早就不在于「AI解不解得出」,而变成了「人类审不审得完」。
审AI的论文是什么滋味?Buckmaster的感触最深——
那份大模型生成的初步证明,是他读过最可怕的东西。他们后来为了抢首发而赶出来的论文,被他自己鄙视为一滩「AI Slop(人工智能泔水)」,并为此公开道歉。
打磨了一年的人类精英尚且被压制得如此狼狈,现在机器一个月直接往脸上吐100多道大题。全世界能审纳维-斯托克斯级别证明的人,两只手数得过来。
所以,这支「九人顾问天团」的真实功能是什么?

说白了,就是OpenAI给这堆机器产物找的一条顶级流水线兼排雷组。
哪道题值得先看?哪道要拆开重写?找谁来核对?署谁的名字?OpenAI把这些脏活累活全丢给了9个不拿工资的大神,而把疯狂刷题的引擎油门,死死攥在了自己手里。
数学界自己也意识到了这场海啸。
多伦多大学数论学家Daniel Litt这几天在X上透露,他跟各系系主任聊完的共识是:激励机制、招聘规范和博士评价方式必须彻底重构。大家已经准备好保卫数学文化,决不再鼓励「单纯生产PDF」。
菲尔兹奖得主Figalli更是预言,数学家的角色,正在从「解题的人」被迫变成「判断哪些题值得解的人」。

如今,OpenAI毫不掩饰地确立了新世界的潜规则:发现归机器,验收和解释归人类。
物理、化学、生物迟早也会走到这一步,每一门学科都会有这么一天。
数学,只是先到了而已。
声明:本文由入驻金色财经的作者撰写,观点仅代表作者本人,绝不代表金色财经赞同其观点或证实其描述。
提示:投资有风险,入市须谨慎。本资讯不作为投资理财建议。
金色财经 善欧巴
动察Beating
Conflux树图区块链
人大金融科技研究所
PANews
