![]()
这两天数学圈又炸了(我为什么要说又)!
9月8日OpenAI官宣拿到了大结果!他们指挥1万个Agent,花了88小时,烧了1300亿token,把人类史上最难的数学问题之一"纳维-斯托克斯方程(NS方程)问题"给解决了!
![]()
消息一出,数学研究者们纷纷表示我不中咧!连数学这么难的东西,都不再是数学家的专属了吗!我决定今晚就用WorkBuddy和豆包证一证哥德巴赫猜想,大家觉得有没有搞头?
然而OpenAI刚官宣完,就有两位数学家发表了pdf小作文当场开撕!他们指控OpenAI用的证明思路来自他们和ChatGPT的对话……
不是,怎么突然有瓜端到我面前了?今天就带大家捋清楚事件的来龙去脉,吃一口新鲜的数学AI瓜!
一、这次AI解决的数学问题有多难?
2000年,克雷数学研究所设立了“千禧年大奖难题”,一共七道,每道悬赏100万美元!
它们分别是黎曼猜想、庞加莱猜想、P=NP问题、霍奇猜想、BSD猜想、杨-米尔斯存在性与质量间隙、纳维-斯托克斯方程的光滑性与解的存在性。
这7道题有多难呢?这么说吧,26年过去了,7道就做出来1道。
2003年,俄罗斯数学家佩雷尔曼解决了庞加莱猜想。然而佩雷尔曼拒绝了这100万美元。他的理由是,觉得数学家汉密尔顿对这个证明的贡献不比自己少,奖只发给自己不公平。
![]()
庞加莱猜想之后,就是今天OpenAI宣布用大模型解决了NS方程问题。
![]()
然而OpenAI表示,这100万美金我也不要
好家伙,合着这奖金就没人要是吧?都不要不如送给我,我来发留言区福利,一个楼层一万美元!
总之,如果这次OpenAI的证明被证明是对的,那留给大家的千禧年问题就只剩5个了。我推荐大家优先挑战看着最简单的P=NP问题,以我之愚见,答案是P=0或N=1,请大家指教
二、NS方程是个啥?我能看懂吗?
能的兄弟能的。小球推一下会动对吧,这个过程满足牛顿第二定律你知道吧。
![]()
把小球变成流体,把力换成压强梯度+黏性+外力,把质量换成密度,把加速度换成随体导数,稍微变个形就得到了NS方程。
![]()
NS方程是流体流动最基本的方程。它由纳维和斯托克斯于1830年左右推导出,此后在降低水利、化工、环境等专业学生的GPA中做出了巨大贡献
有的同学就要问了,这都推导出来了,还未解之谜个啥!
未解之谜点在于,数学家在想这个方程会不会自己崩掉?给一杯水一个平滑的初始状态,让它按NS方程演化下去,它会不会在某个时刻,某一点的速度突然冲向无穷大?
![]()
这个现象数学上叫"爆破"。但这个问题的答案,90年来都没人知道。
OpenAI给出了回答:对任意大小的黏性,都存在一个处处光滑、只作用于有限时空范围的外力,能让一团原本静止的水,在有限时间内于某一点转到无限快,而它的总动能自始至终有限(说实话我也不知道这段话对不对,这段是GPT写的)。
![]()
https://cdn.openai.com/pdf/32d9f210-8b73-45e0-91bc-82a30aef8a9a/navier-stokes.pdf
按理说,AI取得了数学大结果,屋子里应该充满快活的空气啊!但此时,两位数学家跳出来手撕OpenAI!
一位是纽约大学教授Tristan Buckmaster,我们就叫他数学家B哥吧。另一位是Anthropic的研究员、数学家Levent Alpöge,我们就叫他数学家A哥吧。
数学就是从这一刻变成瓜了。
三、卧槽,人类科学家怒了!
8月10日,Anthropic发表论文,把黎曼 ζ 函数临界线上零点比例的下界从 41.6% 提到 67.2%,推动了黎曼猜想这个千禧年问题。A哥担任了论文审稿人。
8月15日,B哥和A哥联手在欧拉方程的爆破解上取得了进展,在通往NS方程的道路上迈了一大步。
A哥眼看成果连连,按捺不住内心的喜悦,开始在推特上开始发一些意义不明的东西,暗示自己要发个大的了。
![]()
要不说人还是不能太得瑟呢,这事很快传到了OpenAI那里,而且越传越歪了。
从“ Anthropic推动了黎曼猜想这个千禧年问题 ”,传成了“ Anthropic解决了一个千禧年问题 ”,又好像传成了“ Anthropic解决了两个千禧年问题 ”。
这下OpenAI慌了, Anthropic是我最大竞争对手啊!这能忍吗!我们必须不遗余力拿下一个千禧年问题首发!
方法也很简单,OpenAI直接把6个千禧年问题都扔到GPT里,让它证一下。
![]()
看来这个时代最创新的科研idea,不是“怎么证明千禧年难题”,而是“想到要用AI证一下千禧年难题”。
很快Agent在NS方程问题上取得了成果!于是OpenAI调集了10000个Agent,token火力全开,集中突破NS方程!
以前我很难想象这种策略。就像我的导师,他带着我一个人永远发不出Nature,但就算给他再招10000个博士,我估计还是发不出Nature。
但这招对AI真管用!最终花了88小时,消耗3000亿个输出Token(其中NS方程消耗1300亿),GPT说,老大,我好像证出来了。
OpenAI研究负责人表示,这一通计算的成本在数百万美元。有网友按API价格反推,认为实际可能在1500万到2250万美元。
看来那100万奖金确实没必要领了,交电费都不够啊!
![]()
但这个时候,B哥彻底怒了。
因为B哥发现,OpenAI的证明方法和自己的冷门思路一样啊!
但据他所知,世界上没有人在研究这个问题。这个方法不太可能是OpenAI把问题扔给GPT,GPT自己就能想出来的!
那GPT是咋想出来的呢?B哥忽然想到,自己写论文的时候用的是OpenAI家的CodeX!思路、公式、论文啥的全都保存在CodeX里!B哥怀疑,OpenAI看了自己的资料。
![]()
哎我真服了B哥,你不是和Claude家的A哥一起搞研究吗?为什么不用 ClaudeCode而用CodeX呢?A哥你也不劝劝他!
我平时都知道,跟阿里合作得用钉钉,腾讯合作得用腾讯文档,字节合作得用飞书。这俩数学家还是没在大厂上过班。
于是B哥去找OpenAI要个说法,OpenAI给了两条路:
方案一,兄弟,你先发你欧拉那篇,我们第二天再官宣NS这篇。
方案二,这篇NS论文给你署名,但有一个条件,A哥的名字得拿掉。数学成果可以谈,但竞争对手的员工不太方便上桌。
总之方案一是把大成果拱手让人,方案二是把A哥拱手让人。
B哥两个方案都拒绝了。最后OpenAI发了论文,B哥也把双方的对话全爆出来了。这下数学证明彻底变成了朴实无华的硅谷商战。
![]()
四、数学与AI的谜题
回到大家最关心的问题,那OpenAI到底有没有偷看呢?
OpenAI表示,我们的研究员肯定没有任何途径看你账号里的工作,但我们无法排除你的数据曾经帮助改进了我们的模型。
总之就是我没专门看你的论文,但我不保证我的模型没有从你的论文里学习。
![]()
这场风波还在继续,这个数学证明也还需要时间来验证。
以前每出一个大证明,数学家们要围着它慢慢咀嚼,感受背后的数学之美,然后从里面长出下一批问题。
![]()
现在大证明一天一个往外冒。你要是现在去数学界找几个低垂的果实,充个会员,说不定真能搞出点什么。信我能证出黎曼猜想还是信我是秦始皇,还真不一定。
2003年,佩雷尔曼因为称赞汉密尔顿的贡献,拒绝独享100万美元。
2026年,OpenAI和Anthropic都不想让对方出成果,人类的重大数学问题此时只剩下了抢先,抢先,抢先。
这不像是AI在证明伟大的数学问题,而是AI公司在通过证明伟大的数学问题来证明自己啊。
1楼 10楼 20楼
一人10美元红包
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.