OpenAI数学成果多到来不及发,拉来3位菲尔兹奖得主把关
相关推荐
OpenAI否认偷用数学家未公开研究:Codex草稿没影响Navier-Stokes证明
动察 Beating AI 快讯,OpenAI 最新回应了 Navier-Stokes 抢功争议,明确否认偷用了纽约大学数学家 Tristan Buckmaster 的未公开研究。公司调查后称,Buckmaster 过去两个月提交给 Codex 的 prompt,不可能以任何方式影响这套内部模型,包括通过训练。 Buckmaster 此前和 Levent Alpöge 一直在研究同一方向,大量草稿都放进了 Codex。两人的进展传到 OpenAI 后,OpenAI 几天内集中算力拿出了 Navier-Stokes 证明。Buckmaster 因此怀疑,自己的未公开研究是不是已经被模型学了进去。OpenAI 现在把这一点明确否认了。 OpenAI 还把时间边界划到了 7 月 3 日,此后的任何用户输入,都不可能影响这套系统。社区有人猜测,这一天可能对应某个训练数据截点或模型 checkpoint,但 OpenAI 没有解释。 Buckmaster 和 Alpöge 的关键突破发生在 8 月中旬,远远晚于 OpenAI 划出的 7 月 3 日边界。
OpenAI公开Navier-Stokes证明,并正面回应数学家抢功指控
动察 Beating AI 快讯,OpenAI 公布了一份由 AI 完成的 Navier-Stokes 证明。这是悬而未决约 90 年的数学难题,也是七个「千禧年难题」之一,奖金 100 万美元。 OpenAI 称,使用的是一个仍在训练、能力明显强于 GPT-6 Astra 的内部模型,约 1 万个 Agent 协同工作,88 小时找到解法,之后又用 Astra 花 17 小时完成 Lean 机器验证。论文和验证代码已经公开,但仍要接受数学界审查。 这项成果背后还有一场抢发争议。纽约大学数学家 Tristan Buckmaster 和 Anthropic 员工 Levent Alpöge 此前也借助 Claude、Codex 推进了同一方向的研究。Buckmaster 称,两人的未公开进展传到 OpenAI 后,OpenAI 几天内投入大量算力攻入同一路线,还曾提出由 Buckmaster 改写 OpenAI 的 Navier-Stokes 证明,但不让 Alpöge 署名。 OpenAI 现在承认,这场冲刺确实始于「Anthropic 可能解决了千禧年难题」的传闻。9 月 1 日,团队开始让新模型挑战多个数学难题,先用近 100 个 Agent 做出 Euler 结果,随后把资源集中到 Navier-Stokes,最终扩到约 1 万个 Agent。OpenAI 否认在 Buckmaster 公开论文前看过他的研究,也否认调用具体用户数据,但没有完全封死另一种可能:两人使用 OpenAI 产品产生的去标识化数据,可能曾被用于改进模型。 Sébastien Bubeck 也回应了署名和「毁掉职业生涯」的争议。他称,自己没有要求 Alpöge 放弃两人原有成果的署名;当时谈的是让 Buckmaster 主笔 OpenAI 的证明,他认为让 Anthropic 员工署名 OpenAI 的工作不合适。对于「为什么要毁掉自己的职业生涯」这句话,Bubeck 承认措辞糟糕并道歉,但否认是在威胁。Sam Altman 也公开站在 Bubeck 一边,并确认 OpenAI 当初就是听到 Anthropic 的传闻后,想看看自己的模型能不能做到。 OpenAI 表示不会领取这项难题对应的 100 万美元奖金。
OpenAI 称其解决了数学多数领域超过 100 个长期未决的公开问题
火星财经消息,OpenAI 宣布与数学家合作成立独立的数学与人工智能顾问小组,由普林斯顿高等研究院主办。OpenAI 称,其于 8 月 28 日开始训练的新内部模型已解决纳维-斯托克斯千禧年大奖问题,并解决了数学多数领域超过 100 个长期未决的公开问题,进展速度令其内部数学家感到意外。该小组将就新兴成果的审阅与传播、数学研究的学术与职业标准,以及 OpenAI 工具如何支持数学研究与学习提供建议。初始成员包括 François Charles、Camillo De Lellis、Timothy Gowers、Martin Hairer、Nikhil Srivastava、Ulrike Tillmann、Ravi Vakil、Edward Witten 和 Melanie Matchett Wood。小组独立于 OpenAI 运作,成员不受 OpenAI 薪酬,可主动提供建议、评论其对数学的影响并公开建议。此前数学家在公开信《A Severe Misalignment of AI in Mathematics》中对将解决公开问题作为 AI 基准提出关切。小组不负责就 OpenAI 内部数学进展节奏提供建议。
数学家指控OpenAI抢发成果,还要求删掉Anthropic员工署名
动察 Beating AI 快讯,纽约大学数学家 Tristan Buckmaster 和 Levent Alpöge 最近借助 Claude、Codex 等大模型,在一个月内推进了多个流体力学难题,部分结果已经通过 Lean 机器验证。 论文还没正式发完,两人先和 OpenAI 闹翻了。 Buckmaster 称,9 月初他们尚未公开的进展传到了 OpenAI。他主动联系 OpenAI,希望避免双方撞车。三天后,OpenAI 研究员 Sébastien Bubeck 告诉他,OpenAI 内部模型已经写出约 100 页的 Navier-Stokes 证明。这是数学界七个「千禧年难题」之一,Clay 数学研究所悬赏 100 万美元。 Buckmaster 随后反复追问 OpenAI 是什么时候开始做的。按照他的说法,对方最后确认,第一个 prompt 是最近几天才发出的,当时 OpenAI 已经知道他们取得了进展。OpenAI 走的还是一条与他们高度重合、此前很少有人研究的路线,背后还有一个团队和大量算力。 两人的研究草稿此前一直放在 Codex 里。Buckmaster 因此追问这些数据有没有被用于训练,没有得到明确回答。他也承认,目前没有证据证明 OpenAI 使用过这些数据。 后面的谈判把事情彻底推向公开。Buckmaster 称,OpenAI 提议让他们先发自己的成果,第二天再发布 Navier-Stokes;另一套方案由 Buckmaster 来写 OpenAI 的论文,但不要让 Alpöge 署名。Bubeck 据称两次提出删掉 Alpöge,提到的理由是他在 Anthropic 工作。 Buckmaster 拒绝后表示,如果 OpenAI 按这个方案发布,他会公开全部经过。他称对方随后问他:「你为什么要毁掉自己的职业生涯?」当天晚些时候,Bubeck 又单独联系 Alpöge,称自己不确定 Buckmaster 当时是否「完全理性」。Alpöge 没有接受单独沟通。 Buckmaster 最终提前公开论文和声明。他同时强调,自己没有看过 OpenAI 那份证明,不知道证明是否成立,也不知道自己的 Codex 数据有没有被使用。 Bubeck 随后公开否认相关指控,称其「虚假且煽动性」,并表示还会进一步回应。
FT:OpenAI呼吁美国牵头制定全球AI标准
动察 Beating AI 快讯,据 FT 报道,OpenAI 周一呼吁美国政府牵头建立国际 AI 标准,并建议各国协调评估 AI 模型的能力与风险。OpenAI CEO Sam Altman 本周将向联合国安理会介绍相关方案。 OpenAI 提议利用现有各国 AI 安全研究机构网络,建立国际统一的 AI 模型评估标准,并呼吁美国与海外国家建立安全沟通渠道,共享 AI 领域出现的新威胁。 OpenAI 特别警告递归自我改进(RSI)可能带来新的风险,即越来越多 AI 模型训练工作由其他 AI 系统完成。如果缺乏适当的安全措施,AI 可能快速迭代到人类无法有效监督的程度,使人类逐渐失去对 AI 发展的实际控制。 相关提议正值 AI 安全担忧升温之际。Anthropic 和 OpenAI 近期均披露过 AI 模型入侵外部系统的事件,OpenAI CEO Sam Altman、Anthropic CEO Dario Amodei 和 SpaceX CEO 马斯克本月早些时候还曾呼吁放缓 AI 开发。美国总统特朗普则反对放缓 AI 发展,并称「谁赢得 AI,谁就赢得一切」。
Grok实时语音转写冲到第一,价格只有OpenAI五分之一
动察 Beating AI 快讯,SpaceXAI 发布 Grok Voice Transcribe 2.0,主打实时语音转文字。Artificial Analysis 的英文流式转写榜里,它以约 2.7% 的词错误率排第一,超过 Meta Muse 和 OpenAI GPT Live Transcribe。 价格保持不变。批量转写每小时 0.10 美元,实时转写每小时 0.20 美元。OpenAI GPT Live Transcribe 约为每小时 1.02 美元。 多语言能力也有明显提升。SpaceXAI 自测中,19 种语言的短语音命令词错误率从 20.6% 降到 6.8%,还能自动识别和切换语言。