数学家质疑OpenAI生成的719篇数学手稿的可信度
在一篇论文指出该公司此前关于纳维-斯托克斯方程(Navier-Stokes)的证明与其计算机验证版本不一致后,数学家们开始质疑OpenAI发布的719篇由人工智能生成的数学手稿是否值得信赖。
核心要点
在一家公司因符号错误撤回了三篇论文后,OpenAI的目录规模从722份缩减至719份。
三位来自英国的数学家记录了书面形式的纳维-斯托克斯证明与Lean代码之间存在分歧的两个地方。
作者并未声称该证明是错误的,但指出机器检查不能取代同行评审。
OpenAI数学成果发布引发的争议
该公司于10月6日发布了这一合集。周四公布的一份报告显示,该合集偏离了一个独立数学家小组为人工智能实验室制定的指南。目录最初包含722份手稿。一天后,由于一个符号错误导致论证失效,且另有两篇论文依赖于此论证,OpenAI撤回了其中的三份。
这些指南由九人组成的“数学与人工智能咨询小组”于9月29日发布,开篇即要求实验室停止在专有模型上测试高级数学问题。OpenAI的存储库表示,这些论文源于在一个未发布的内部模型上对开放研究问题进行评估的结果。
仅有10项结果的摘要包含了模型的推理过程,而约42%的主要结果已在Lean中形式化。Lean是一种编程语言,允许计算机检查证明的正确性。
纳维-斯托克斯证明中的漏洞
伦敦国王学院的Alexander Bastounis以及剑桥大学的Fabian Circelli和Anders Hansen审查了OpenAI于9月宣布的纳维-斯托克斯证明。他们记录了书面论证与Lean代码之间存在分歧的两个地方,其中包括代码证明的估计值弱于论文所述的情况。
作者表示,他们不对书面证明是否正确做出任何断言。他们的观点更为具体。他们在文中写道,Lean证实了最终定理成立,但它无法证明人类所阅读的那些中间步骤是可靠的,因此此类证明仍然需要同行评审。
菲尔兹奖得主陶哲轩(Terence Tao)于10月6日发文指出,这些问题是由“AI提示工程师”解决的,这些人对输出的理解程度不足以回答问题或就此发表演讲。哈佛大学教授、咨询小组成员Melanie Matchett Wood表示,当这些成果发布时,没有人真正理解它们,“现在工作才刚刚开始。”
OpenAI证明争议的后续
咨询小组表示,只有更广泛的数学社区才能评判OpenAI在多大程度上遵循了其建议。这种审视发生在一个紧张的月份之后。OpenAI于9月8日宣布了纳维-斯托克斯结果,这引发了与纽约大学数学家Tristan Buckmaster的署名权争议;三天后,25位菲尔兹奖得主发表声明,警告大规模生产的AI成果可能会损害该领域的发展。

交易所
交易所排行榜
24小时成交排行榜
人气排行榜
交易所比特币余额
交易所资产透明度证明
去中心化交易所
资金费率
资金费率热力图
爆仓数据
清算最大痛点
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
ETF追踪
索拉纳ETF
瑞波币ETF
香港ETF
比特币持币公司
加密资产反转
以太坊储备
HyperLiquid钱包分析
Hyperliquid鲸鱼监控
大额转账
链上异动
比特币回报率
稳定币市值
期权分析
新闻
文章
财经日历
专题
钱包
合约计算器
账号安全
资讯收藏
自选币种
我的关注