OpenAI一口气放出722篇AI数学手稿,数学界开始验收
相关推荐
OpenAI公开Navier-Stokes证明,并正面回应数学家抢功指控
动察 Beating AI 快讯,OpenAI 公布了一份由 AI 完成的 Navier-Stokes 证明。这是悬而未决约 90 年的数学难题,也是七个「千禧年难题」之一,奖金 100 万美元。 OpenAI 称,使用的是一个仍在训练、能力明显强于 GPT-6 Astra 的内部模型,约 1 万个 Agent 协同工作,88 小时找到解法,之后又用 Astra 花 17 小时完成 Lean 机器验证。论文和验证代码已经公开,但仍要接受数学界审查。 这项成果背后还有一场抢发争议。纽约大学数学家 Tristan Buckmaster 和 Anthropic 员工 Levent Alpöge 此前也借助 Claude、Codex 推进了同一方向的研究。Buckmaster 称,两人的未公开进展传到 OpenAI 后,OpenAI 几天内投入大量算力攻入同一路线,还曾提出由 Buckmaster 改写 OpenAI 的 Navier-Stokes 证明,但不让 Alpöge 署名。 OpenAI 现在承认,这场冲刺确实始于「Anthropic 可能解决了千禧年难题」的传闻。9 月 1 日,团队开始让新模型挑战多个数学难题,先用近 100 个 Agent 做出 Euler 结果,随后把资源集中到 Navier-Stokes,最终扩到约 1 万个 Agent。OpenAI 否认在 Buckmaster 公开论文前看过他的研究,也否认调用具体用户数据,但没有完全封死另一种可能:两人使用 OpenAI 产品产生的去标识化数据,可能曾被用于改进模型。 Sébastien Bubeck 也回应了署名和「毁掉职业生涯」的争议。他称,自己没有要求 Alpöge 放弃两人原有成果的署名;当时谈的是让 Buckmaster 主笔 OpenAI 的证明,他认为让 Anthropic 员工署名 OpenAI 的工作不合适。对于「为什么要毁掉自己的职业生涯」这句话,Bubeck 承认措辞糟糕并道歉,但否认是在威胁。Sam Altman 也公开站在 Bubeck 一边,并确认 OpenAI 当初就是听到 Anthropic 的传闻后,想看看自己的模型能不能做到。 OpenAI 表示不会领取这项难题对应的 100 万美元奖金。
数学家指控OpenAI抢发成果,还要求删掉Anthropic员工署名
动察 Beating AI 快讯,纽约大学数学家 Tristan Buckmaster 和 Levent Alpöge 最近借助 Claude、Codex 等大模型,在一个月内推进了多个流体力学难题,部分结果已经通过 Lean 机器验证。 论文还没正式发完,两人先和 OpenAI 闹翻了。 Buckmaster 称,9 月初他们尚未公开的进展传到了 OpenAI。他主动联系 OpenAI,希望避免双方撞车。三天后,OpenAI 研究员 Sébastien Bubeck 告诉他,OpenAI 内部模型已经写出约 100 页的 Navier-Stokes 证明。这是数学界七个「千禧年难题」之一,Clay 数学研究所悬赏 100 万美元。 Buckmaster 随后反复追问 OpenAI 是什么时候开始做的。按照他的说法,对方最后确认,第一个 prompt 是最近几天才发出的,当时 OpenAI 已经知道他们取得了进展。OpenAI 走的还是一条与他们高度重合、此前很少有人研究的路线,背后还有一个团队和大量算力。 两人的研究草稿此前一直放在 Codex 里。Buckmaster 因此追问这些数据有没有被用于训练,没有得到明确回答。他也承认,目前没有证据证明 OpenAI 使用过这些数据。 后面的谈判把事情彻底推向公开。Buckmaster 称,OpenAI 提议让他们先发自己的成果,第二天再发布 Navier-Stokes;另一套方案由 Buckmaster 来写 OpenAI 的论文,但不要让 Alpöge 署名。Bubeck 据称两次提出删掉 Alpöge,提到的理由是他在 Anthropic 工作。 Buckmaster 拒绝后表示,如果 OpenAI 按这个方案发布,他会公开全部经过。他称对方随后问他:「你为什么要毁掉自己的职业生涯?」当天晚些时候,Bubeck 又单独联系 Alpöge,称自己不确定 Buckmaster 当时是否「完全理性」。Alpöge 没有接受单独沟通。 Buckmaster 最终提前公开论文和声明。他同时强调,自己没有看过 OpenAI 那份证明,不知道证明是否成立,也不知道自己的 Codex 数据有没有被使用。 Bubeck 随后公开否认相关指控,称其「虚假且煽动性」,并表示还会进一步回应。
OpenAI公开内部模型产出的722篇数学手稿
PANews 10月7日消息,OpenAI在X平台发帖称,将发布由一款内部前沿模型产出的一系列新数学成果,发布方式参考了普林斯顿高等研究院“数学与人工智能顾问组”的建议。其GitHub仓库显示,目前共收录722篇手稿,分为372个成果族;部分附有Lean形式化证明,但并非全部完成验证,OpenAI称部分未经形式化的结果可能存在问题,后续将持续更新。
OpenAI 28天冲刺首日:GPT-6 Astra和6.1 Sol提速约50%
动察 Beating AI 快讯,OpenAI 产品与平台主管 Thibault Sottiaux 公布 28 天产品冲刺的首日更新。GPT-6 Astra 和 GPT-6.1 Sol 的默认生成速度已经优化,官方称整体约提升 50%。 这次提速不仅覆盖 Codex 和 ChatGPT Work。通过「Sign in with ChatGPT」使用 ChatGPT 订阅额度的第三方产品也会同步生效,包括 OpenCode、Pi、Amp 和 Devin 等。用户不需要修改任何设置,更新会自动推送。 OpenAI 此前承诺,未来 28 天每天要么交付一项对多数 Codex / Work 用户有明确改善的更新,要么直接重置用户额度。这次提速就是 Day 1。
OpenAI给Codex开28天冲刺:每天有明显改进,否则重置额度
动察 Beating AI 快讯,OpenAI 产品与平台主管 Thibault Sottiaux 宣布,接下来 28 天,Codex 和 ChatGPT Work 每天要么交付一项「对大多数用户有明确改善」的更新,要么进行一次 full reset(重置额度)。 前一天,Sottiaux 还说团队已经「锁定目标」。用户反馈已经很清楚,大家希望产品变得更简单。接下来团队只做四类事情:简化产品、提高效率让用户获得更多可用量、突破性功能,以及新模型。 这番表态是因为赶上 Codex 正面临更强的外部竞争。Anthropic 发布 Opus 5.5 后,社区里 Claude Code 和 Codex 的对比明显增多,讨论主要集中在模型能力、速度和订阅额度。
MiniMax把OpenAI新Agents API做成开源版,Codex、Claude Code都能接
动察 Beating AI 快讯,MiniMax 开源 OpenAgentCore,做了一套兼容 OpenAI Agents API 的自托管实现。开发者可以继续使用 OpenAI 官方 SDK,只需要换掉 API 地址,后台运行的 Agent 可以选择 Codex、Claude Code 或 MiniMax Code。 Agents API 可以理解成一套「调用 Agent 的统一接口」。普通模型 API 主要负责一问一答。Agent 要连续干几个小时甚至几天,还要管理上下文、调用工具、协调子 Agent、保存任务进度。OpenAI 的 Agents API 把这些能力放到一个长期运行的 Session 里统一管理。 OpenAI 官方版本使用 OpenAI 托管的 Codex 执行框架。开发者可以自己选择代码在哪运行,但 Agent 的任务编排、上下文管理和运行状态仍由 OpenAI 负责。OpenAgentCore 则把这套后端也交给开发者自己部署。