星光澄海 | BLOG

OpenAI用未发布模型发布一批数学问题的解法

OpenAI刚晒出722份手稿,藏着372组数学问题的解法——这些解法来自一款还没公开的前沿模型。这事没上热搜,但数学圈已经吵成两派:有人拍桌说终于啃下老难题,有人皱眉头怕砸了学术的锅。

这些解法,不是单篇论文那么简单
OpenAI这次的发布,是打包式的722份手稿,归类成372个“结果族”——就是同一类问题的相关解法整合。AGMAI这个新成立的独立精英数学家咨询组,专门对接这事,说这里头涵盖了“数百个”公开未解决的数学问题。重点是,这些解法的源头不是已经推出的模型,是一款还没放出来的前沿货。没发布就意味着没人知道它的参数、训练数据,连能力边界都摸不透,这也是争议的核心之一。

数学界的矛盾反应,戳中了老问题
原文说,这事儿让数学界“既印象深刻又不安”。印象深刻是因为真解决了长期卡壳的硬骨头,不是小打小闹的凑数成果;不安的点,OpenAI也没藏着——就是研究伦理和学术行为的漏洞。比如:AI生成的解法算不算学术成果?能发在正规期刊吗?会不会有人拿AI的解法当自己的,或者用AI抄别人的?还有,数学家的核心工作,到底是“发现”还是“验证”?AI帮着发现了,那验证的门槛是不是变低了?AGMAI的存在,其实是OpenAI试图填坑的一步——找一帮专业数学家,把结果的传播和后续处理捋顺,避免乱套。

对其他人,这事儿的影响分两面
对AI公司来说,这是实打实的突破——前沿模型不止能搞代码、写文案,还能碰基础数学的硬骨头。但没发布的模型,也意味着没法验证这些解法的真实性,暂时还吹不出“AI统治数学”的牛。对数学家来说,不是失业,是多了个工具——但也得重新定义自己的工作,比如以前靠算力解决不了的,现在用AI能试试,那接下来的竞争,会不会变成“谁会用AI谁更厉害”?对普通读者来说,不用太激动,因为模型没发,细节没公开,你连解法具体是什么都不知道,看热闹就行。

我的判断是,AI在数学领域的突破,已经从“边角料”变成“真家伙”了。但学术圈还没准备好应对这种新情况——比如怎么审查AI生成的成果,怎么给数学家划分AI的使用边界,这些都是空白。最后留个问题:当AI开始啃人类几百年啃不动的数学硬骨头时,我们是该先给学术圈搭一套专属的“AI解法审查规则”,还是让它先自由生长,等出了乱子再补?


素材来源:The Verge AI · AI情报、科研前沿
查看报道原文

发表第一条评论吧

支持 Markdown