人类的数学研究要被AI接管了?

2026-09-11 05:25:05 · chineseheadlinenews.com · 来源: 采铜的书房

(一)

大事件

今天报出一个惊天大消息,OpenAI公司用内部的在研大模型攻克了一个著名的数学难题——纳维-斯托克斯(Navier-Stokes)方程的存在性与光滑性问题。

其证明过程包含了如下令人惊诧的数字:

使用了大约一万个并发智能体(agent)。

智能体之间的相互沟通、协作,共发送了270万条消息。

消耗了大约1300亿个输出token。

证明时间花费了88个小时,随后用17小时完成Lean的形式化验证。

大力出奇迹。

一个困扰了数学家90年之久的举世难题就这样在四五天的时间里,被一股机器智能的洪荒之力给解决了。

可谓强撸灰飞烟灭。

试问,现在全世界的数学家是什么心情?在读的数学研究生又是什么心情?是欣喜若狂还是黯然神伤还是五味杂陈?

要知道,OpenAI这么做并不是为了推进数学研究本身,而只是“秀肌肉”和“扳手腕”,是用一个标志性的成果来展示自己模型的强大,故而可以跟最有实力的竞争者Anthropic继续一较高下。

假设OpenAI和Anthropic并不是想在数学领域“秀一把而已”,而是继续长期地推进,那岂不是意味着数学领域中的大量悬而未决的问题都会以排山倒海之势成批解决?那如果这样的话,那还要那么多数学家何用,还要那么多数学研究生何用?

换句话说,有可能人类的数学研究在不久的将来会被AI接管,“整盘端走”。

如果这真的发生了,这对人类来说到底是好事还是坏事?

(二)

数学之为文明

人类为什么要研究和发展数学?为什么有人愿意成为数学家,毕生醉心于数学研究?很多数学家会告诉你说:数学之中蕴含着一种美,一种纯粹的美,一种简洁而优雅的美。

并且,在数学之中,或许就暗藏着宇宙的终极秘密。数学的前沿探索与物理学的发展息息相关,数学就好像是一部解释宇宙的“天书”,一部终极的密码本。而解开这部天书的雄心,搭载着人类最高程度的智慧和探索欲望。

还有一点值得说的是,数学领域中有一些著名的猜想和难题,而数学家研究这些难题的目的,并不仅仅是为了解决这些问题本身,更不是简单地去挣一笔奖金而已,其意义更在于在探索这些难题的过程中,能加深和拓宽对数学某个领域的整体性了解,发展出一些全新的数学方法,甚至开辟某个新的数学分支。

基于以上的三点认识,我们再去评价现在的AI数学研究,就会得到一些与众不同的认识:

AI解决的数学难题,需要人类数学家的评审和确认。数学家要花很多的时间去读懂这个证明,并审核其是否正确,这一过程一定会比较漫长(数年时间)。即便AI真的解决了某个数学难题,那么这个解决给数学界带来的意义是不确定的:

可能只是一种“暴力求解”,证明的过程并无人类数学家可感受的“数学之美”。

仅仅是解决了这个问题,但是解决这个问题对更大范围内的数学研究的启发和拓展看不到。

还有一种可能,人类最终都没看懂AI的证明。

当AI能够成批量地解决数学难题时,那就意味着很可能其中有一些研究是人类数学家看不懂的,或者即便看得懂,也根本没时间看完。打个比方,这就好像两个武林高手对决,其中一个高手出剑的速度特别快,对方还没看清楚就已经身中一剑。弱的那方不仅打不过对面,而且还不知道自己是怎么败下来的,败在哪个招式上。

那么,当这一状况变成了某种常规,那就意味着数学这个学科内部出现了断裂。何谓断裂?就是说,由于人类数学家来不及或者没能力确认AI研究的成果,故而也无法利用这些成果,无法从这些成果中受到启发和激励,更谈不上从中获得思维的乐趣和美的享受,于是乎:人类数学家变得不知道该怎么做来继续推动数学学科的发展。

说得更简单直接一点,既然现在的AI已经走在了人类知识的最前沿,那么下一步,AI就会大量创造超出人类理解能力的知识,对于这些知识,人类能不能驾驭它们?所以,这其实不仅仅是一个数学家要担心的问题。传说中的“潘多拉盒子”难道指的就是AI吗?

(三)

AI做的飞机你敢坐吗?

让我们做一个思想实验:

假设现在由一个非常强大的大模型,在没有人类任何干预的状况下,只是从一句提示词“请帮我设计和制造一家真实的飞机”开始,就自行设计和制造了一架飞机(调用机器人完成生产过程,并自行测试),那么这架飞机,你敢坐吗?

作为一架全流程都由AI设计和制造的飞机,对它的安全性的顾虑在于:人类专家很可能并不能真正看懂其软件以及硬件系统里的全部东西。——这就跟人类数学家可能看不懂AI的数学证明一样。

如果人类看不懂,那又怎样检查核准这架飞机在每一个环节上的安全性呢?怎样保证AI做的所有这些事里面没有一个bug?

当然你可以说,AI可以自己检查和测试这架飞机的安全性,找出潜在的bug。但是,如果AI的测试方法本身是有bug的呢?

没错,现在的AI应用已经如火如荼,但是这些应用大体都是在“并非性命攸关”的场景中。假如在性命攸关的场景中大面积地使用AI,你能毫无心理负担地去用吗?

这个问题的实质是:在AI的能力已经超出了人类理解力的情形下,我们如何确保AI不会犯错,以及我们如何确保AI不会伤害人类?

所以,今天的大新闻,即OpenAI对NS方程的证明,很可能开启了一个崭新的智能纪元。这件事情证明了,scaling law在极为高级的智力探索中依然有效,并且已经能够碾压人类智力的上限。

这就意味着,接下来,或许具有最先进大模型的公司可以研究和开发出各种超出人们想象之外的“黑科技”,而这些黑科技对“人类共同体”的影响是未知的,是极为不确定的。

或许,一本“黑魔法”正在渐渐打开。我们会看到惊涛骇浪吗?


    24小时新闻排行榜更多>>
  1. 泰国名寺住持侵吞9200万泰铢被捕
  2. 为会晤铺路 习近平访美前 中国采购百万吨美国大豆
  3. 习近平接班人会是谁?日经关注上海这位70后
  4. 夜店撒钱 豪车成排 林誉轩认罪:$2.45亿比特币是偷的
  5. 最新爆料:青岛造船厂起火外籍货轮涉“影子船”
  6. 华人女子希腊失踪 护照被撕成22块碎片 附近有骸鼻
  7. 周恩来也有不必忍的时候 周差点枪毙了毛泽东
  8. 末日论者曝惊人AI实验
  9. 中国制坦克突膛炸 孟加拉演习2死1重伤 士兵喷飞画面曝
  10. 这个国家,快把兄弟们得罪光了
  11. 如何真正提高投资的回报?
  12. 美债抛售叠加供给潮施压
  13. 德国收紧对华签证审批 提到航天、5G就危险了?
  14. 丝绒长裙+大背头,高圆圆惊艳全场
  15. 大西洋月刊爆料:美专家和台退役军官差点打起来
  16. 中美正就300亿美元对等降税框架安排进行磋商
  17. 青岛造船厂外籍货轮起火增至25死 习近平下指示
  18. 中国手机开屏广告害死人 “魔法画报”耽误急救老人离世
  19. 中国游客掐颈天鹅摆拍
  20. 伊朗镐山存在施工活动
  21. 灵活就业人员医保新政来了,政策真的有用吗?
  22. 为什么现代人越来越离不开零食?其危害是什么
  23. 毛泽东去世50周年 大学生受访落泪 评论区讽刺一片
  24. 中国《国防动员法》升级 为可能的武统量身定制?
  25. 梅姨首任丈夫:知道她心狠人懒,但不知这么坏
  26. OpenAI首席科学家:异类心智正在诞生 恐脱离掌控
  27. 25周年纪念日:“9·11”事件时间线
  28. 刘翔的微博和上海体育局的“情况说明”
  29. 阿尔卑斯山重大事故!旅行团翻车 48乘客多人死伤
  30. 京东收购德国电子零售巨头遇阻
  31. 刘翔“切割”不到24小时,十年无子隐情曝光
  32. 美住房部长企图拍打女议员臀部,被全程直播
  33. “身带弓”魔咒 中南海谶纬大清洗深度推演
  34. 9·11恐袭25年后,纽约的“归零”与重生
  35. 刘翔安置事件尘埃落定,但他说的第三条路在哪里?
  36. 捐款5年,谁在电话那头笑
  37. 金融圈最炸裂父子当庭翻脸
  38. 中国驻日本大使馆:调整对日签证规费
  39. 西北政法大学发布通告
  40. 信任崩盘,愤怒的日本年轻人对高市早苗“脱粉回踩”
  41. 遭183次水刑、裸体拘押,“9·11”案主犯还没判
  42. 国家电视台前外籍专家揭露新闻审查机制
  43. 纽约2977架无人机重现世贸双子塔
  44. 逃离病房,一群妈妈的特殊旅行
  45. 挖出104个人头骨,这里到底什么来头?
  46. 组图:洛杉矶法轮功学员大炼功 迎中秋话感恩
  47. 法轮大法润泽哥大校园 讲真相一年变化显着
  48. 卢比奥访问秘鲁:强调此事必要性
  49. 教体局回应“60平以下无法入学”
  50. 年轻人最奢侈的下班活动:干针线活
  51. 川普要发钱,引发合法性等疑问
  52. 伊朗如何绕过制裁?路透:用石油跟中国“以物易物”
  53. 中国人居然被台湾“这一个词汇”震撼了!
  54. 美国预告:下周制裁一家大型银行
  55. 浓眉大眼de饶毅论文数据造假:比刘光慧严重
  56. 弯刺蔷薇缘何成为月季的抗寒育种亲本?
  57. 放弃高薪大厂去当老师的人,开始变多了
  58. 油价飙升叠加通胀压力,亚洲股债双杀
  59. 香港投行遭遇现实考验
  60. 这一次,文艺青年最后的体面崩了