2026-09-09 15:42

人类的数学研究要被AI接管了?

author_path 采铜的创想世界©
头图

本文来自微信公众号: 采铜的书房 ,作者:采铜


(一)


大事件


今天报出一个惊天大消息,OpenAI公司用内部的在研大模型攻克了一个著名的数学难题——纳维-斯托克斯(Navier-Stokes)方程的存在性与光滑性问题。


其证明过程包含了如下令人惊诧的数字:


  • 使用了大约一万个并发智能体(agent)。


  • 智能体之间的相互沟通、协作,共发送了270万条消息。


  • 消耗了大约1300亿个输出token。


  • 证明时间花费了88个小时,随后用17小时完成Lean的形式化验证。


大力出奇迹。


一个困扰了数学家90年之久的举世难题就这样在四五天的时间里,被一股机器智能的洪荒之力给解决了。


可谓强撸灰飞烟灭。


试问,现在全世界的数学家是什么心情?在读的数学研究生又是什么心情?是欣喜若狂还是黯然神伤还是五味杂陈?


要知道,OpenAI这么做并不是为了推进数学研究本身,而只是“秀肌肉”和“扳手腕”,是用一个标志性的成果来展示自己模型的强大,故而可以跟最有实力的竞争者Anthropic继续一较高下。


假设OpenAI和Anthropic并不是想在数学领域“秀一把而已”,而是继续长期地推进,那岂不是意味着数学领域中的大量悬而未决的问题都会以排山倒海之势成批解决?那如果这样的话,那还要那么多数学家何用,还要那么多数学研究生何用?


换句话说,有可能人类的数学研究在不久的将来会被AI接管,“整盘端走”。


如果这真的发生了,这对人类来说到底是好事还是坏事?


(二)


数学之为文明


人类为什么要研究和发展数学?为什么有人愿意成为数学家,毕生醉心于数学研究?很多数学家会告诉你说:数学之中蕴含着一种美,一种纯粹的美,一种简洁而优雅的美。


并且,在数学之中,或许就暗藏着宇宙的终极秘密。数学的前沿探索与物理学的发展息息相关,数学就好像是一部解释宇宙的“天书”,一部终极的密码本。而解开这部天书的雄心,搭载着人类最高程度的智慧和探索欲望。


还有一点值得说的是,数学领域中有一些著名的猜想和难题,而数学家研究这些难题的目的,并不仅仅是为了解决这些问题本身,更不是简单地去挣一笔奖金而已,其意义更在于在探索这些难题的过程中,能加深和拓宽对数学某个领域的整体性了解,发展出一些全新的数学方法,甚至开辟某个新的数学分支。


基于以上的三点认识,我们再去评价现在的AI数学研究,就会得到一些与众不同的认识:


AI解决的数学难题,需要人类数学家的评审和确认。数学家要花很多的时间去读懂这个证明,并审核其是否正确,这一过程一定会比较漫长(数年时间)。即便AI真的解决了某个数学难题,那么这个解决给数学界带来的意义是不确定的:


    1. 可能只是一种“暴力求解”,证明的过程并无人类数学家可感受的“数学之美”。


    2. 仅仅是解决了这个问题,但是解决这个问题对更大范围内的数学研究的启发和拓展看不到。


    3. 还有一种可能,人类最终都没看懂AI的证明。


    当AI能够成批量地解决数学难题时,那就意味着很可能其中有一些研究是人类数学家看不懂的,或者即便看得懂,也根本没时间看完。


那么,当这一状况变成了某种常规,那就意味着数学这个学科内部出现了断裂。何谓断裂?就是说,由于人类数学家来不及或者没能力确认AI研究的成果,故而也无法利用这些成果,无法从这些成果中受到启发和激励,更谈不上从中获得思维的乐趣和美的享受,于是乎:人类数学家变得不知道该怎么做来继续推动数学学科的发展。


说得更简单直接一点,既然现在的AI已经走在了人类知识的最前沿,那么下一步,AI就会大量创造超出人类理解能力的知识,对于这些知识,人类能不能驾驭它们?所以,这其实不仅仅是一个数学家要担心的问题。传说中的“潘多拉盒子”难道指的就是AI吗?


(三)


AI做的飞机你敢坐吗?


让我们做一个思想实验:


假设现在由一个非常强大的大模型,在没有人类任何干预的状况下,只是从一句提示词“请帮我设计和制造一家真实的飞机”开始,就自行设计和制造了一架飞机(调用机器人完成生产过程,并自行测试),那么这架飞机,你敢坐吗?


作为一架全流程都由AI设计和制造的飞机,对它的安全性的顾虑在于:人类专家很可能并不能真正看懂其软件以及硬件系统里的全部东西。——这就跟人类数学家可能看不懂AI的数学证明一样。


如果人类看不懂,那又怎样检查核准这架飞机在每一个环节上的安全性呢?怎样保证AI做的所有这些事里面没有一个bug?


当然你可以说,AI可以自己检查和测试这架飞机的安全性,找出潜在的bug。但是,如果AI的测试方法本身是有bug的呢?


没错,现在的AI应用已经如火如荼,但是这些应用大体都是在“并非性命攸关”的场景中。假如在性命攸关的场景中大面积地使用AI,你能毫无心理负担地去用吗?


这个问题的实质是:在AI的能力已经超出了人类理解力的情形下,我们如何确保AI不会犯错,以及我们如何确保AI不会伤害人类?


所以,今天的大新闻,即OpenAI对NS方程的证明,很可能开启了一个崭新的智能纪元。这件事情证明了,scaling law在极为高级的智力探索中依然有效,并且已经能够碾压人类智力的上限。


这就意味着,接下来,或许具有最先进大模型的公司可以研究和开发出各种超出人们想象之外的“黑科技”,而这些黑科技对“人类共同体”的影响是未知的,是极为不确定的。


或许,一本“黑魔法”正在渐渐打开。我们会看到惊涛骇浪吗?

本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。