郭震 AI公众号:郭震AI

实时 AI 消息

OpenAI被曝又在另一道千禧年难题上取得进展,传闻指向霍奇猜想

《纽约时报》最新追访补出了OpenAI与纽约大学数学家Tristan Buckmaster冲突的更多细节,其中OpenAI更新了关于用户数据的说法,称Buckmaster近两个月的Codex提示词绝不可能影响内部模型。在纳维-斯托克斯方程之后,OpenAI又表示已在另一道千禧年大奖难题上取得“实质性进展”并准备公布结果,外界传闻目标指向霍奇猜想,但该说法尚未得到确认。

发布时间

《纽约时报》最新的追访报道,为OpenAI与纽约大学数学家Tristan Buckmaster之间的冲突补出了此前没有披露的细节,其中最受关注的一条,是OpenAI更新了关于用户数据的说法。

据这篇报道,OpenAI现在的表述是:Buckmaster过去两个月提交的Codex提示词,绝不可能以任何方式影响内部模型,7月3日之后的任何用户输入也不可能进入这套系统。这比它此前“无法完全排除匿名用户数据曾帮助改进模型”的说法明确得多,等于为8月公布的研究成果是否使用过用户数据划出了一条时间线。不过报道同时指出,这仍然是OpenAI单方面给出的说法,目前没有公开技术材料可供外界独立核查。

数据争议还没有落地,OpenAI又抛出了新的信息:在纳维-斯托克斯方程之后,公司又在另一道千禧年大奖难题上取得“实质性进展”,正在准备公布结果。最新传闻把下一个目标指向霍奇猜想,但这一说法来自未经证实的线索,OpenAI并未确认,此前外界也只是把它当作“传闻中的传闻”。

回顾争议的起点:Buckmaster称,在他拒绝OpenAI提出的合作方案、并表示可能公开双方沟通经过后,OpenAI研究负责人Sébastien Bubeck对他说“你为什么要毁掉自己的职业生涯”。Bubeck后来承认第一句话确实出自自己之口,但否认那是在威胁,并称这是“极其糟糕的措辞”,自己当场收回并道歉。

《纽约时报》此次补出的,是那场谈判更完整的条件。当时OpenAI已经完成纳维-斯托克斯证明,而Buckmaster和合作者Levent Alpöge只推进到更简单的欧拉方程。OpenAI给出的选项包括:两位数学家先发布欧拉方程成果、OpenAI第二天再公布纳维-斯托克斯证明;由Buckmaster担任主要作者,重新整理模型生成的论文;为他提供充足算力继续自己的研究;以及公开建议100万美元的千禧年大奖荣誉归Buckmaster和合作者。报道也说明,OpenAI并非要直接支付这笔奖金,也没有证据显示双方讨论过封口协议;但Buckmaster仍然觉得,这是在“收买”自己。

症结落在Alpöge身上。他任职于Anthropic,但这项研究属于他的个人业余项目,并非Anthropic发起;Bubeck在接受采访时明确表示,OpenAI确实不希望Alpöge出现在最终论文中,理由是“怎么能让一名Anthropic员工参与OpenAI内部项目”。Buckmaster则认为,两人的研究同时用到了Anthropic的Claude与OpenAI的Codex,最合理的办法是两家公司放下竞争、共同处理这项成果。

争议真正的刺痛点,或许不在数据,而在功劳归属。Buckmaster强调,人类数学家为这次突破铺出了道路:几年前,西班牙数学家Diego Córdoba和Luis Martínez-Zoroa提出了一套通过一连串精确外力“踢击”把流体推向极端状态、最终逼出奇点的新策略;他负责设置问题,Alpöge把问题输入模型,两人再根据模型输出不断反馈、修正,逐步解决更复杂的方程。按过去的研究节奏,这套方法本可能由不同数学家继续接力十年,而OpenAI调动上万个Agent,把这段路压缩到了几天。周一接近午夜,Buckmaster仓促公开了三篇尚未来得及充分润色的论文和一份1870词的事件说明;几个小时后,OpenAI正式宣布完成纳维-斯托克斯证明。

这套“刷题系统”的规模也随披露浮出水面。据OpenAI透露,相关内部模型从8月28日开始训练,数学能力已显著超过GPT-6 Astra,甚至在纳维-斯托克斯项目进行期间训练还没有结束;它被接入一个由上万个Agent组成的系统,同时尝试多道尚未解决的千禧年难题,整轮测试产生了490万条Agent消息和约3000亿个输出Token。仅纳维-斯托克斯一题,就动用约1万个并行Agent、270万条消息和约1300亿个输出Token,从Agent启动到找到解法只用了88小时,随后GPT-6 Astra又花17小时完成Lean形式化和验证。

把最近半个月的消息放在一起看,这更像一场被传闻点燃、迅速升级的AI数学竞赛,而非一次孤立的突破:OpenAI和Anthropic这对宿敌瞄准的都是千禧年难题这类数学界的“终极Boss”。七道千禧年难题中,此前只有庞加莱猜想获得正式解决,如果纳维-斯托克斯证明最终通过审查,就还剩五道。对数学家而言,硬币的另一面同样真实:他们提出问题、积累路线、把未公开草稿交给AI工具,最后却可能发现,工具背后的公司正在与自己抢跑——Buckmaster对《纽约时报》说,与一家万亿美元公司对抗非常可怕。接下来值得关注的是,纳维-斯托克斯的论文能否通过同行审查,以及OpenAI所说的下一道难题成果何时公布、霍奇猜想这一传闻是否属实。

为什么重要

这条新闻的关键不只是又一道数学难题,而是AI实验室正把世纪难题当成可批量刷的测试集,并在此过程中与企业外部的数学家产生关于数据使用、署名与合作方式的正面冲突。它把AI科研的算力优势与学术界的优先权、信任问题同时推到了台面上。

微博邮件

OpenAI数学推理AI Agent
返回实时消息

附近消息

全部