网易首页 > 网易号 > 正文 申请入驻

AI能解千禧难题,也能杀死人类?华尔街日报拉响末日警报

0
分享至


新智元报道


AI已经强到能解开人类最难的数学题,也能杀光我们。

说这话的,是《华尔街日报》专栏作家Ben Cohen。

9月11日,他写了一篇关于AI和数学的专栏。

Cohen坦白自己不懂纳维-斯托克斯方程,但他认为,你不需要懂任何数学,也能明白OpenAI这次声称取得的突破意味着什么:

AI的进步正在加速,而且这种加速令人恐惧。


一条数学圈的硬核新闻,一下子变成了关乎所有人类命运的问题。

同一天,陶哲轩等25位菲尔兹奖得主联名发布声明:《AI在数学中的严重失配》(A Severe Misalignment of AI in Mathematics)。


他们说的「失配」,是指AI公司和数学家想要的东西对不上:数学家要的是新方法、新理解,AI公司要的是拿名题给模型刷分。

一边是专栏作家在喊末日,一边是顶级数学家在谈失配。

如果你把这一周的事情排在一起看,就会明白他们为什么坐不住了:

9月3日,GPT-6 Astra发布,在FrontierMath Tier 4拿到97.6%;

9月5日,OpenAI一个尚未发布的内部模型,在首批智能体启动约88小时后,得到纳维-斯托克斯问题的一套解法;

9月8日,OpenAI公开结果,当天就被NYU数学家指控抢跑,还闹出了「不让Anthropic员工上论文」的署名争议;

9月10日,Epoch AI宣布FrontierMath Tier 4已经饱和;

9月11日,25位菲尔兹奖得主联名发声。当晚,《华尔街日报》把数学突破和AI灭绝风险放进了同一个标题。

七天,五件事都指向这样一个缺口:AI创造知识的速度、人类确认知识的速度与规则调整的速度,正在严重脱节。

14个月

AI击穿最难数学基准

FrontierMath Tier 4,这是一个由Epoch AI设计,专门测试最强模型的一组研究级数学题。

这里的题极其变态,有些题目,哪怕是顶尖研究者也要花上几天才能解开。

2025年7月Tier 4刚上线时,最强模型只能做出5%左右,基本等于交白卷。

可不到14个月,Epoch宣布:每一道Tier 4题,都至少被AI解出过一次。

其中,最后一题由GPT-6 Astra拿下,出题人是数学家Jay Pantone。

Epoch还特意提到:过去数学家经常抱怨模型靠「意外捷径」绕过自己精心设计的题,但最后这一道,没走捷径。

随后,Epoch甩出一个冷酷结论:这个基准已经饱和。


考卷,已经追赶不上考生了,该换卷了。

Epoch也已经把战场向真正的开放问题转移,AI评测体系开始转向人类自己也不知道答案的盲区。

AI能力增长的速度,已经跑赢了我们测量它的方法。

就像Epoch的Greg Burnham所感叹的:一个时代落幕,另一个时代开启。

88小时

AI第一次像个研究所那样运转

如果说FrontierMath证明的是「基准开始追不上模型」,那么纳维-斯托克斯事件展示的则是一幅更具颠覆性的画面:

AI不只是会做题,它已经开始像一个庞大的科研组织那样运转了。

这根本不是一次单打独斗,而是一场多达一万个智能体的「大兵团作战」。

它们被分成不同的小组,有的证明,有的证伪,彼此通信、共享中间结论,甚至在中途无缝切换最新版本的模型。

首批智能体启动约88小时后,其中一个组交出了一份长达百页的最终证明。


OpenAI公布的纳维-斯托克斯奇点机制示意:流体向内螺旋(inward spiral)、沿轴拉伸(axial stretching),橙色为高速旋转区,青色为低速区。涡心越缩越快,速度无界而总能量有限。

这一整个流程,完美复刻了人类顶尖科研机构的运作模式。

机器狂奔88小时生成结果

人类确认却要以年计

在人类世界里,纳维-斯托克斯的状态依然是「未解决」。


按千禧年奖的规则,一个解答先要在合格渠道发表,发表后至少等两年,并获得全球数学共同体的普遍接受,Clay才会启动正式审议。

Clay主席Martin Bridson对AFP说,评估过程「刻意不急」,而且必须「绝对严格」。OpenAI自己也说了,不打算申领这100万美元。

因此,这件事最准确的说法是:OpenAI公布了一套千禧年难题的解法,声称已完成Lean形式化验证,但尚未得到数学共同体的独立确认。

机器生成结果,88小时。人类确认结果,至少两年,这恐怕是本周AI数学最刺目的一组反差。

这不是说人类验证太慢。问题出在机器把「发现」加速了几百倍,人类的「理解」并没有跟着加速。

所以,真正的问题是,当机器开始以「几天一个重大结果」的节奏批量生产知识,之后几年甚至几十年的阅读、检查、解释、简化和吸收,谁来做?

署名制度最先撞墙

纳维-斯托克斯结果公开的当天,数学圈炸锅了。

NYU数学家Tristan Buckmaster和在Anthropic任职的Levent Alpöge,整个8月其实也一直在研究相关的流体方程。

按照《纽约时报》的还原,这两人工作的方式如下:

Buckmaster提出问题,Alpöge把问题丢给Anthropic内部模型;模型生成结果之后,两人再根据输出调整问题,继续往回喂数据。

按照Buckmaster的说法,事后,OpenAI提出过多个安抚方案:允许他先发布自己的结果、让他成为OpenAI论文的第一作者、提供算力让他继续研究。

但最大的障碍是:OpenAI不想让Levent出现在论文上。


黑板上是Buckmaster和Alpöge整个8月的进展时间线:欧拉方程8月15日、Lean形式化8月22日、8月31日……还有Figalli、Hairer等同行的名字。

在商言商,一个OpenAI投入重金的内部项目,凭什么要署上竞争对手Anthropic员工的名字?

随后,事情又延伸到了另一个更为敏感的话题。Buckmaster过去数月一直在使用Codex整理AI生成的数学草稿。

那么,他输入Codex但尚未公开的独家科研思路,有没有可能通过隐秘的数据管线,成为了OpenAI自己研究模型的养料?

Buckmaster自己承认没有证据,但在他看来,事件的时间线和OpenAI的证明路线,都在暗示着这一点。

OpenAI则在9月10日紧急更新公告称,经内部彻查,Buckmaster过去两个月的Codex提示词绝对不可能通过训练或其他任何方式影响这套内部模型。

谁对谁错,这里暂时成了一笔糊涂账,但它真正暴露出来的,是一整组过去从来没人认真回答过的问题:

一个人的私有提示词到底算不算受保护的科研资料?

企业内部的砸钱研究项目能不能署竞争对手公司员工的名字?

如果模型参考过海量的公开资料,又该怎样界定新的贡献与既有工作的边界?

普林斯顿高等研究院的Peter Sarnak对《纽约时报》说:「这种讨价还价,我这辈子没听说过。」

数学界几百年沉淀下来的学术规则,从来没有为这种狂暴的机器生产速度设计过防撞带。

25位菲尔兹奖得主真正担心的事

就在一天后,25位菲尔兹奖得主联合扔出了一份重磅声明。

陶哲轩、Peter Scholze、James Maynard、Maryna Viazovska……数学圈最顶尖的大脑几乎全员出动。


这份声明,并非什么「反AI檄文」。

事实上,陶哲轩本人一直都在极其积极地尝试用AI辅助数学研究。

而且声明也承认,AI确实有潜力加速真正的数学理解。

他们真正深恶痛绝的是将「解题」直接等同于数学,在当下狂热的AI圈,AI公司为了股价和宣发,正在急功近利地把「解掉名题」当成最高优化目标。

在他们眼里,千禧年大奖难题似乎只是用来证明模型有多牛的跑分工具。

但数学的真正宝贵之处,是在枯燥的解题过程中诞生新方法和新概念,最终沉淀成人类的共同知识体系。

现在AI公司隔三差五就甩出一个震撼结果,快到没人来得及消化。这条传了几千年的链条,随时可能断掉。

联名信还特别点出,结果发得太快,这些解答根本来不及清楚区分哪些是新想法、哪些是踩着前人的肩膀,从而势必带来严重的署名与归属混乱。

为什么一个数学突破

会和「末日警告」挂上钩?

普通人真正关心的,不是「AI超过了数学家」。

是机器创造知识的速度,第一次以碾压姿态,快过了人类确认、归属、消化知识的速度。

这并非危言耸听,GPT-6 Astra系统卡写明,它是OpenAI第一个达到网络安全「Critical」阈值的模型,在ExploitBench上拿了100%。

解千禧年难题的组织能力、零日漏洞的攻击能力、更难被看清的推理,三样东西在同一个模型身上同时具备。

OpenAI在纳维-斯托克斯公告的最后一段,还有一句话:

接下来他们要先把这个新模型摸透,再决定往前冲多快,可能需要对进展速度做更审慎的选择。

是的,刚交出千禧年难题答卷的AI公司,主动谈起了减速。

Cohen还在专栏末尾提到了一件事。

上个月,OpenAI把一批顶尖数学家请到旧金山办公室开闭门会,假设AI终将在数学上超越人类,然后大家再来讨论教育怎么办、科研合作怎么办、论文发表怎么办、下一代数学家还怎么培养。


谈了一天,没有答案。

这道题,也没法打包交给Lean去自动验证。

只能人类自己解。

参考资料:

https://www.wsj.com/tech/ai/ai-math-millennium-prize-safety-openai-anthropic-05179825

https://epoch.ai/benchmarks/frontiermath-tier-4-v2?view=graph&tab=release-date

https://www.nytimes.com/2026/09/10/science/tristan-buckmaster-openai-math-navier-stokes.html?utm_source=chatgpt.com

https://www.daniellitt.com/blog/2026/8/11/the-end-of-mathematics/

编辑:元宇

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
相比于美版,国行iPhone18 Pro“阉割”了5大功能

相比于美版,国行iPhone18 Pro“阉割”了5大功能

互联网.乱侃秀
2026-09-13 10:02:26
真离谱啊!华为三折叠被骂上天,苹果一出折叠屏,中文互联网竟然对折叠屏的评价逆转了!

真离谱啊!华为三折叠被骂上天,苹果一出折叠屏,中文互联网竟然对折叠屏的评价逆转了!

谭谈社会
2026-09-11 11:09:56
成功率只有千分之一,AI短剧几乎全员亏损

成功率只有千分之一,AI短剧几乎全员亏损

硅基降临
2026-09-11 15:23:56
WTT澳门冠军赛男单太残酷:随着张本智和3-4,亚洲军团已全军覆没

WTT澳门冠军赛男单太残酷:随着张本智和3-4,亚洲军团已全军覆没

侧身凌空斩
2026-09-13 14:24:41
敬一丹抢救细节曝光:在哈尔滨脑出血,紧急转院回京抢救了三个月

敬一丹抢救细节曝光:在哈尔滨脑出血,紧急转院回京抢救了三个月

娱乐圈圈圆
2026-09-13 09:10:31
攻下红海咽喉岛屿,胡塞武装打电话给美国:别介入!此前沙特两次求助特朗普遭拒

攻下红海咽喉岛屿,胡塞武装打电话给美国:别介入!此前沙特两次求助特朗普遭拒

红星新闻
2026-09-13 15:50:23
赢球就成世界第一!松岛辉空输球后不满中国观众:开闪光灯 无法原谅

赢球就成世界第一!松岛辉空输球后不满中国观众:开闪光灯 无法原谅

念洲
2026-09-13 09:02:26
WTT澳门冠军赛:张本智和被淘汰!3:4无缘决赛,男单决赛席位出炉

WTT澳门冠军赛:张本智和被淘汰!3:4无缘决赛,男单决赛席位出炉

国乒二三事
2026-09-13 14:27:17
国乒无缘包揽冠亚军!张本美和4-1战胜陈幸同,约战超新星陈熠

国乒无缘包揽冠亚军!张本美和4-1战胜陈幸同,约战超新星陈熠

乒谈
2026-09-13 13:18:13
2-1!莱巴金娜首夺美网冠军 大满贯第3冠 终结萨巴伦卡美网19连胜

2-1!莱巴金娜首夺美网冠军 大满贯第3冠 终结萨巴伦卡美网19连胜

我爱英超
2026-09-13 06:44:02
闹剧彻底结束!官方接连出手,熊某迎4大坏消息,终为荒唐买了单

闹剧彻底结束!官方接连出手,熊某迎4大坏消息,终为荒唐买了单

凡知
2026-09-12 12:28:10
央视《兰香如故》:顶着一张老脸却硬要演美女,谁的审美出了问题

央视《兰香如故》:顶着一张老脸却硬要演美女,谁的审美出了问题

翰飞观事
2026-09-13 10:19:20
女选手疑似赛场失禁,HYROX中国:将更换地毯,并开展全场深度消杀

女选手疑似赛场失禁,HYROX中国:将更换地毯,并开展全场深度消杀

都市快报橙柿互动
2026-09-13 08:46:53
敬一丹离世丨父母是干部,老公是富豪,女儿是学霸,女婿是外籍

敬一丹离世丨父母是干部,老公是富豪,女儿是学霸,女婿是外籍

动物奇奇怪怪
2026-09-13 13:23:50
画面不堪入目,地下人奶交易乱象,成年人躺进怀里吃奶的灰色黑产

画面不堪入目,地下人奶交易乱象,成年人躺进怀里吃奶的灰色黑产

易玄
2026-09-12 10:24:46
敬一丹因脑出血离世,医生提醒:这5个信号出现一个就要警惕

敬一丹因脑出血离世,医生提醒:这5个信号出现一个就要警惕

人民日报健康客户端
2026-09-13 13:58:24
太恶心了!尖沙咀女生裙背露出大吊牌,网民举报到商家,评论区骂声一片

太恶心了!尖沙咀女生裙背露出大吊牌,网民举报到商家,评论区骂声一片

火山詩话
2026-09-13 05:21:53
让用户道歉,国产手机是专业的

让用户道歉,国产手机是专业的

神不隆通
2026-09-13 07:44:30
报名费22万!上海站离谱内幕:日薪3千招聘安保 层层外包只剩60

报名费22万!上海站离谱内幕:日薪3千招聘安保 层层外包只剩60

念洲
2026-09-13 09:03:19
“不用再对中国试探了,他们不会饶了我们。”日本提高中国签证费后,中国也涨了,这个结果反倒让日本格外清醒。

“不用再对中国试探了,他们不会饶了我们。”日本提高中国签证费后,中国也涨了,这个结果反倒让日本格外清醒。

回京历史梦
2026-09-13 12:36:58
2026-09-13 17:19:00
新智元 incentive-icons
新智元
AI产业主平台领航智能+时代
16175文章数 67068关注度
往期回顾 全部

科技要闻

三位AI大佬,罕见呼吁AI减速

头条要闻

特朗普:我非常希望看到爱尔兰统一 即使英国会有意见

头条要闻

特朗普:我非常希望看到爱尔兰统一 即使英国会有意见

体育要闻

乔丹的得分统治力:如何违背篮球规律?

娱乐要闻

主持人敬一丹去世,女儿悲痛发讣告

财经要闻

“1+N+X”!私募业,监管规则密集落地!

汽车要闻

全新配色和新样式轮毂 乐道L80星光设计套装限时惊喜价10080元

态度原创

健康
教育
时尚
艺术
亲子

手脚发麻口齿不清?也可能是中风!

教育要闻

孩子上大学,家长迟迟不愿离校是什么心态

伊姐周六热推:电视剧《生逢其时》;综艺《大哥小助理》......

艺术要闻

18.96米!北京交通大学雄安南门,是亚洲第一高校门?

亲子要闻

4岁女儿不会写数字,把媳妇都给急坏了,看看老公是如何做的?

无障碍浏览 进入关怀版