OpenAI28天冲刺Day4:Sol超快档最高8倍速,Codex支持实时纠偏
相关推荐
OpenAI 28天冲刺首日:GPT-6 Astra和6.1 Sol提速约50%
动察 Beating AI 快讯,OpenAI 产品与平台主管 Thibault Sottiaux 公布 28 天产品冲刺的首日更新。GPT-6 Astra 和 GPT-6.1 Sol 的默认生成速度已经优化,官方称整体约提升 50%。 这次提速不仅覆盖 Codex 和 ChatGPT Work。通过「Sign in with ChatGPT」使用 ChatGPT 订阅额度的第三方产品也会同步生效,包括 OpenCode、Pi、Amp 和 Devin 等。用户不需要修改任何设置,更新会自动推送。 OpenAI 此前承诺,未来 28 天每天要么交付一项对多数 Codex / Work 用户有明确改善的更新,要么直接重置用户额度。这次提速就是 Day 1。
OpenAI为GPT-6.1 Sol推出Ultrafast模式,速度最高提升8倍
PANews 10月9日消息,OpenAI Developers在X平台发帖称,GPT-6.1 Sol的Ultrafast模式今日起在API、Codex及ChatGPT Work中陆续上线,智能水平接近GPT-6 Astra,速度最高可达Sol标准模式的8倍。据OpenAI开发者社区公告,该模式API输入定价为每百万token收费12美元、输出为每百万token收费60美元,为Astra的1.2倍;在Codex及ChatGPT Work中仅向Pro 500、符合条件的按量计费企业版及按积分计费教育版用户开放。
OpenAI给Codex开28天冲刺:每天有明显改进,否则重置额度
动察 Beating AI 快讯,OpenAI 产品与平台主管 Thibault Sottiaux 宣布,接下来 28 天,Codex 和 ChatGPT Work 每天要么交付一项「对大多数用户有明确改善」的更新,要么进行一次 full reset(重置额度)。 前一天,Sottiaux 还说团队已经「锁定目标」。用户反馈已经很清楚,大家希望产品变得更简单。接下来团队只做四类事情:简化产品、提高效率让用户获得更多可用量、突破性功能,以及新模型。 这番表态是因为赶上 Codex 正面临更强的外部竞争。Anthropic 发布 Opus 5.5 后,社区里 Claude Code 和 Codex 的对比明显增多,讨论主要集中在模型能力、速度和订阅额度。
OpenAI 推出 GPT-6.1 Sol 模型,性能接近 Astra
ChainCatcher 消息,OpenAI 推出 GPT-6.1 Sol 模型,其性能接近 Astra,但标准词元价格仅为 Astra 的五分之一。
OpenAI修复GPT-6图像Bug,Luna视觉定位翻倍
动察 Beating AI 快讯,OpenAI 修复了 GPT-6 Sol 和 GPT-6 Luna 的一个图像编码 Bug。这个问题会降低模型对图片的理解能力,修复后 API 和 Codex 的视觉任务都会改善,包括让 Agent 看屏幕操作电脑的 Computer Use。 OpenAI 公布的测试中,GPT-6 Luna(Max)在 RefCOCOg 视觉定位评测上的平均 IoU 从 28.8% 升到 60.0%,提高 31.2 个百分点。这个测试主要看模型能不能根据一句描述,在图片里准确找到对应的物体或区域。 两款模型 9 月 22 日才正式上线 API,OpenAI 的更新日志在 9 月 25 日就记录了这次修复。官方没有公布 Sol 的具体提升,也没有说明 Bug 从什么时候开始、影响了多少图片请求。 OpenAI 还罕见地建议使用图片输入的开发者重新跑一遍评测,并重试此前受影响的工作流。
OpenAI 发布 GPT-6 Sol 与 Luna,API 价格下调 50%
ChainCatcher 消息,OpenAI 于 9 月 22 日发布 GPT-6 Sol 与 GPT-6 Luna 两款新模型,发布时间距 Anthropic 推出 Claude Opus 5.5 仅数分钟。两款模型定位低于 GPT-6 Astra,是面向日常工作的更便宜、更快速选项。OpenAI 同时将两款模型的 API 价格较 GPT-5.6 促销价下调 50%,Sol 输入与输出价格分别为每百万 token 2 美元与 10 美元,Luna 则降至 0.1 美元与 0.5 美元。性能方面,OpenAI 援引 Zapier 的 AutomationBench 基准称,GPT-6 Sol 在最高推理设置下得分为 33.2%,每任务成本 0.27 美元,而 Claude Opus 5 最高设置为 26.9%,每任务成本高出逾 11 倍。在 Agents' Last Exam 测试中,GPT-6 Sol 最高得分 56.4%。在 OSWorld 2 计算机使用测试中,GPT-6 Sol 以 60.5% 对 60.3% 几乎追平 Claude Opus 5 的中等努力得分,成本低约 80%。