OpenAI否认偷用数学家未公开研究:Codex草稿没影响Navier-Stokes证明
相关推荐
OpenAI公开Navier-Stokes证明,并正面回应数学家抢功指控
动察 Beating AI 快讯,OpenAI 公布了一份由 AI 完成的 Navier-Stokes 证明。这是悬而未决约 90 年的数学难题,也是七个「千禧年难题」之一,奖金 100 万美元。 OpenAI 称,使用的是一个仍在训练、能力明显强于 GPT-6 Astra 的内部模型,约 1 万个 Agent 协同工作,88 小时找到解法,之后又用 Astra 花 17 小时完成 Lean 机器验证。论文和验证代码已经公开,但仍要接受数学界审查。 这项成果背后还有一场抢发争议。纽约大学数学家 Tristan Buckmaster 和 Anthropic 员工 Levent Alpöge 此前也借助 Claude、Codex 推进了同一方向的研究。Buckmaster 称,两人的未公开进展传到 OpenAI 后,OpenAI 几天内投入大量算力攻入同一路线,还曾提出由 Buckmaster 改写 OpenAI 的 Navier-Stokes 证明,但不让 Alpöge 署名。 OpenAI 现在承认,这场冲刺确实始于「Anthropic 可能解决了千禧年难题」的传闻。9 月 1 日,团队开始让新模型挑战多个数学难题,先用近 100 个 Agent 做出 Euler 结果,随后把资源集中到 Navier-Stokes,最终扩到约 1 万个 Agent。OpenAI 否认在 Buckmaster 公开论文前看过他的研究,也否认调用具体用户数据,但没有完全封死另一种可能:两人使用 OpenAI 产品产生的去标识化数据,可能曾被用于改进模型。 Sébastien Bubeck 也回应了署名和「毁掉职业生涯」的争议。他称,自己没有要求 Alpöge 放弃两人原有成果的署名;当时谈的是让 Buckmaster 主笔 OpenAI 的证明,他认为让 Anthropic 员工署名 OpenAI 的工作不合适。对于「为什么要毁掉自己的职业生涯」这句话,Bubeck 承认措辞糟糕并道歉,但否认是在威胁。Sam Altman 也公开站在 Bubeck 一边,并确认 OpenAI 当初就是听到 Anthropic 的传闻后,想看看自己的模型能不能做到。 OpenAI 表示不会领取这项难题对应的 100 万美元奖金。
数学家指控OpenAI抢发成果,还要求删掉Anthropic员工署名
动察 Beating AI 快讯,纽约大学数学家 Tristan Buckmaster 和 Levent Alpöge 最近借助 Claude、Codex 等大模型,在一个月内推进了多个流体力学难题,部分结果已经通过 Lean 机器验证。 论文还没正式发完,两人先和 OpenAI 闹翻了。 Buckmaster 称,9 月初他们尚未公开的进展传到了 OpenAI。他主动联系 OpenAI,希望避免双方撞车。三天后,OpenAI 研究员 Sébastien Bubeck 告诉他,OpenAI 内部模型已经写出约 100 页的 Navier-Stokes 证明。这是数学界七个「千禧年难题」之一,Clay 数学研究所悬赏 100 万美元。 Buckmaster 随后反复追问 OpenAI 是什么时候开始做的。按照他的说法,对方最后确认,第一个 prompt 是最近几天才发出的,当时 OpenAI 已经知道他们取得了进展。OpenAI 走的还是一条与他们高度重合、此前很少有人研究的路线,背后还有一个团队和大量算力。 两人的研究草稿此前一直放在 Codex 里。Buckmaster 因此追问这些数据有没有被用于训练,没有得到明确回答。他也承认,目前没有证据证明 OpenAI 使用过这些数据。 后面的谈判把事情彻底推向公开。Buckmaster 称,OpenAI 提议让他们先发自己的成果,第二天再发布 Navier-Stokes;另一套方案由 Buckmaster 来写 OpenAI 的论文,但不要让 Alpöge 署名。Bubeck 据称两次提出删掉 Alpöge,提到的理由是他在 Anthropic 工作。 Buckmaster 拒绝后表示,如果 OpenAI 按这个方案发布,他会公开全部经过。他称对方随后问他:「你为什么要毁掉自己的职业生涯?」当天晚些时候,Bubeck 又单独联系 Alpöge,称自己不确定 Buckmaster 当时是否「完全理性」。Alpöge 没有接受单独沟通。 Buckmaster 最终提前公开论文和声明。他同时强调,自己没有看过 OpenAI 那份证明,不知道证明是否成立,也不知道自己的 Codex 数据有没有被使用。 Bubeck 随后公开否认相关指控,称其「虚假且煽动性」,并表示还会进一步回应。
OpenAI下一代生图模型GPT-Image-2.5即将发布:Codex已经预埋发布页
动察 Beating AI 快讯,OpenAI 可能很快更新生图模型。社区研究者从最新版 Codex Desktop 前端里翻出了 imagegen-25-announcement-modal 和 imageGen25Announcement 等字符串,还强制唤出了隐藏弹窗。弹窗写着「图像创作迎来重大升级」,主打更高画质、更快生成和更智能的创作工具。
OpenAI给Codex连挖3人:Linear产品负责人+Kairos两位创始人加盟
动察 Beating AI 快讯,OpenAI 一天内给 Codex 和 ChatGPT 连挖 3 人。Linear 产品负责人 Nan Yu 宣布加入 OpenAI,结束在 Linear 4 年的工作。随后,Kairos Computer 两位联合创始人 Manas Bam 和 Samarth Patel 也宣布加入,三人去向都是 Codex 和 ChatGPT。 Kairos 做的是能直接操作电脑的个人 Agent。它给 Agent 一台云端电脑,让它自己登录网站、操作浏览器和软件,跨应用完成任务。两位创始人说,他们创办 Kairos 时想做「每个人的个人 AGI」,现在准备去 OpenAI 继续做这件事。
OpenAI测试Codex持续运行模式:任务做完还能继续跟进
动察 Beating AI 快讯,OpenAI 正在测试 Codex 的 Persistent mode,也就是持续运行模式。普通 Agent 完成一次任务后通常就会停止,而这个模式可以让 Codex 完成当前任务后,继续检查和处理后续事项。相关代码已经出现在 Codex 的公开仓库中,但 OpenAI 表示近期没有上线计划。
Codex额度真有问题:OpenAI查出3处额外消耗,明天全量Reset
动察 Beating AI 快讯,OpenAI 终于查到 Codex 额度掉得快的具体原因了。负责人 Tibo Sottiaux 称,团队已经发现 3 处额外消耗:带图片的超长会话反复压缩上下文时效率偏低;Computer History 在部分高消耗场景里用量过高;甚至自动生成会话标题的功能,也比预期多吃了一些额度。 Tibo 此前先称没有发现整体异常,又把部分受影响用户指向 sub2api 和订阅共享。昨天他才进一步承认,部分用户的缓存命中率确实变差,可能导致额度消耗加快。现在调查终于定位到了 Codex 自身的几个具体问题。 其中「上下文压缩」是为了让 Codex 在超长任务里不断压缩旧内容,腾出上下文继续工作。OpenAI 官方资料也确认,Codex 会自动使用 compaction 维持长时间任务。图片很多、连续压缩多次时,现在这套流程存在额外浪费。Computer History 则是最近上线的功能,可以把 Mac 上选定 App 和网页里的操作记录带进 ChatGPT 和 Codex。 OpenAI 会在美国时间周日推送修复,同时给所有付费订阅的 Codex 用量做一次完整 Reset。Tibo 称 Reset 预计美国西海岸时间下午 2 点左右上线,对应北京时间 8 月 24 日凌晨 5 点左右。 团队还找到了一种无关的新优化方案,称能显著提高效率,下周会继续推进。