新智元报道
OpenAI尚有大招!
奥特曼刚演示的内部模子Astra,,,,一口吻在10个数学难题取得重大突破!
这249页的PDF,,,,在整个数学圈都是很是炸裂的水平。。。。
论文:https://cdn.openai.com/pdf/ten-proofs-oai.pdf
证实:https://openai.com/index/ten-advances-in-mathematics/
Github开源Lean证实:https://github.com/openai/ten-proofs
数学家、美国数学学会Fellow、罗格斯大学优异教授Alex Kontorovich难掩震惊,,,,只留两个赞叹号。。。。
这是一个足以载入史册的分水岭时刻:无论在数学领域,,,,照旧AGI的征程上。。。。
说得直白些:若是这些效果经受住整个学界的磨练,,,,那么单是今天的这一轮宣布,,,,便堪称现代史上相关领域单日跨度最大的一次飞跃!
Claude Fable 5更是直言:「凭证菲尔茨奖标准,,,,任何一项都足以获奖」!
最令人震惊的是,,,,破解这十浩劫题,,,,OpenAI竟然只用了2000美元。。。。
数学界地动!载入AI史册的一刻
五月份,,,,OpenAI宣布了AI发明的埃尔德什单位距离意料的反例。。。。
但现在确认了,,,,这是OpenAI的下一代模子Astra破解的,,,,也是奥特曼现在正在给美国国会演示的谁人模子。。。。
现在,,,,OpenAI又分享了Astra在至少十年没有希望的难题上的最新效果。。。。
这些问题涉及高维几何、编码理论、算术电路重漂后、群论、算子代数、量子重漂后、格密码学和极值组合学等普遍领域。。。。
新闻一出,,,,数学圈瞬间炸锅!
其中,,,,最精彩的效果,,,,可能是Astra终结了Gromov自1999年提出的非sofic群问题。。。。
钱学森母校加州理工学院的某位数学博士称:「这是菲尔茨奖级别的效果」!
凭证Epoch AI的OpenMath的评分标准,,,,GPT-5.6 Sol Pro和Fable 5 Max以为:
大部分效果都能获得偕行的高度认可,,,,被评为「Major Advance」(重大前进)。。。。
唯独第三项,,,,具有破圈的潜质,,,,有望成为整年数学领域最佳效果之一,,,,被评为「突破」。。。。
第三项效果也是一个反例:
OpenAI Astra结构出无限有限泛起的非sofic群,,,,否认「所有可数群都是sofic」的意料。。。。
曼彻斯特大学皇家学会大学研究员、数学家Thomas Bloom直言:这次突破比此前OpenAI证伪单位距离意料更主要。。。。
并且,,,,天生这10项突破性效果证实的总本钱,,,,若是按Sol API价钱盘算还不到2000美元,,,,平均200美元。。。。
也就是说,,,,解决一个有科研价值的意料约莫只相当于一名研究生一个周末的津贴。。。。
而这一切,,,,竟只是评估一个未宣布模子时意外收获的「副产品」。。。。
另一点,,,,各人不注重看,,,,可能就忽略了:
这10个意料是OpenAI精选之后的效果!
OpenAI推理模子的焦点创立者Noam Brown直接放出重话。。。。
他直言,,,,OpenAI确实实验过其他难题,,,,现在还没有乐成解决一个类似黎曼意料这样的千禧年大奖难题。。。。
但更要害的是,,,,测试时盘算远未封顶,,,,连百万美元级别的天下性难题也可能被啃下。。。。
让人既感伤又伤感:数学还会是人类心智的荣耀吗?????
249页PDF,,,,太震撼了
这份249页的论文之以是震惊数学界,,,,不在于盘算推演,,,,而在于AI如数学巨匠般,,,,在几何、代数、群论等领域同时完成降维攻击式的证实与证伪。。。。
一次在多个差别的领域,,,,取得多项硬核突破,,,,或许无人能及。。。。这自己就让人印象深刻。。。。这次我们主要先容3大问题。。。。
斩断世纪执念:找出史上首个「非Sofic群」
1999年,,,,俄罗斯数学家、「数学诺贝尔奖」挪威阿贝尔奖得主Mikhail Gromov提出了sofic群的看法。。。。
Sofic,,,,来自希伯来语「有限」。。。。
通俗地说,,,,若是一个无限大的重大群,,,,能够用有限的置换去完善迫近、模拟它的局部乘法表,,,,那它就是Sofic的。。。。
你可以把它想象成「无论何等重大的无限三维模子,,,,都能用有限的像素点(体素)完善渲染出来」。。。。
问题随之而来:所有可数群,,,,都是sofic群吗?????
这不是一个冷清的手艺细节。。。。Sofic群的性子牵动着sofic熵理论、动力系统遍历论、算子代数等一整片数学国界。。。。若是这个问题的谜底是「否」,,,,那就意味着保存某种基础上无法被有限结构迫近的群——整个理论框架都要重新审阅。。。。
27年间,,,,无数顶尖数学家实验结构反例,,,,无一乐成。。。。
Astra给出的谜底是:结构出一个无限有限泛起的非sofic群。。。。
OpenAI Astra直接从数学的代码库里拎出了一个现成的结构:「二元Leavitt代数的单位群」,,,,然后甩出一份无懈可击的证实:这个群绝对不可能被有限置换迫近!
为了证实这一点,,,,AI的操作极其狞恶,,,,它把Kun-Thom扩展图理论和著名的「汤普森群V(Thompson's group V)」糅合在一起,,,,硬生生逼出了一个逻辑矛盾。。。。
这就好比人类还在随处寻找无法被像素化的物质,,,,AI直接指着桌上的一个高维魔方说:「别找了,,,,就是它,,,,我证实给你们看。。。。」
完整结构。。。。有论证。。。。有细节。。。。
更要害的是:用Lean 4做了形式化验证,,,,并附上机械可自力磨练的证书。。。。
这是分水岭所在。。。。Lean 4的证书意味着,,,,每一个推理方法都经由了机械的形式化核验,,,,不保存靠「感受对」蒙混过关的空间。。。。
数学家Elliot Glazer第一时间确认新闻属实,,,,并称这是「迄今最主要的AI辅助数学效果」。。。。
击碎46年冰封的结界:高维球体群集问题
想象一下你有一个纸箱,,,,怎么塞下最多的橘子?????
在三维天下里,,,,人类直到几百年前才通过开普勒意料搞明确。。。。而到了高维空间,,,,这个问题变得犹如梦魇。。。。
2022年,,,,数学家Maryna Serhiivna Viazovska由于解出了8维和24维的球体群集(Sphere Packing)问题,,,,拿下了数学界的最高声誉「菲尔兹奖」。。。。
震撼点:直接突破了自1978年以来人类在这个领域的「智力天花板」。。。。
但注重,,,,她解出的是「特定维度」。。。。
若是维度走向无限大,,,,密度上限究竟是几多?????
自1978年两位苏联数学家给出一个极限后,,,,整整46年,,,,全天下最顶尖的数学家寸步难行,,,,连小数点后几位都优化不了。。。。
而这次,,,,AI轻描淡写地走入了这个死胡同。。。。
它不但给出了全新的证实,,,,还直接准确算出了Cohn-Elkies线性妄想的指数衰减率,,,,首次突破了1978年的界线!
这就好比人类在这座高山前爬了半个世纪爬不动了,,,,AI直接开着直升机登顶,,,,顺便把上山的路给铺平了。。。。
逾越菲尔兹奖得主直觉,,,,推翻Connes刚性意料
1982年的菲尔兹奖得主、非交流几何的涤讪人Alain Connes提出了著名的「刚性意料」:关于某类极其特殊的群,,,,它们天生的冯·诺依曼代数(von Neumann algebra)就像指纹一样唯一无二。。。。
几十年来,,,,数学家们一直在这个意料的迷宫里打转。。。。
效果,,,,OpenAI的新模子不但走出了迷宫,,,,还把迷宫给拆了。。。。
它不但证实晰康纳是错的,,,,并且给出了一种极致碾压的证伪方式:它没有只找出一个反例,,,,而是直接结构出了一个「可数无限的群家族」。。。。
这些群相互之间互差别构(长得完全纷歧样),,,,但它们天生的冯·诺依曼代数却完完全全一模一样!
这就好比Connes曾断言「世上没有两片雪花拥有相同的内部原子结构」,,,,而AI不但找到了两片,,,,它反手直接下了一场狂风雪,,,,每一片雪花外观各异,,,,但焦点代数结构全等。。。。
数学家的「破壁者」来了
「AI教父」辛顿预言:
在未来10到20年内,,,,AI甚至可能创立出人类无法明确的新数学。。。。
而OpenAI这次的效果让谁人时间表看起来都太守旧了。。。。
除硬核数学证实外,,,,OpenAI下一代模子Astra还知道怎样使用「条件概率」去攻克量子纠缠游戏,,,,知道怎样使用「多项式求导」去建设盘算重大性下界。。。。
解决这类问题需要真正的推理,,,,OpenAI Astra掌握了极其深邃的纯数学直觉与结构能力。。。。OpenAI这次还特意果真了完整推演历程:
https://cdn.openai.com/pdf/reasoning-walkthroughs.pdf
这或许是一个明确的例子:AI比人类最好的数学家还智慧。。。。
关于数学界来说,,,,这篇论文无异于宣告着数学家的「破壁者」,,,,已经来了。。。。
参考资料:
https://cdn.openai.com/pdf/ten-proofs-oai.pdf
https://openai.com/index/ten-advances-in-mathematics/
https://x.com/stalkermustang/status/2083485500250198453
编辑:大卫