美股盘前要闻一览:美国8月PCE今晚出炉;市场屏息以待美光财报;OpenAI推迟GPT-6.1 Astra发布
相关推荐
OpenAI 推出 GPT-6.1 Sol 模型,性能接近 Astra
ChainCatcher 消息,OpenAI 推出 GPT-6.1 Sol 模型,其性能接近 Astra,但标准词元价格仅为 Astra 的五分之一。
OpenAI推出法律版GPT-6 Astra,法律研究正确率提升40%
动察 Beating AI 快讯,OpenAI 推出 Astra for Law,把 GPT-6 Astra 做成专门面向法律工作的版本。它加入法律检索、分析和写作能力,可以帮律师查判例、分析案件、起草文件,也能接入律所现有的工作流。 OpenAI 还新建了一套法律搜索索引,可以查询美国判例、法规、法院规则等超过 2.3 亿个 URL,覆盖 99.9% 以上已公开的美国先例判决。 在 200 道美国法律研究题中,Astra for Law 的整体正确率达到 54.0%,普通 GPT-6 Astra 加网页搜索为 38.7%,相对提升约 40%。在判例题上,它找到的参考案例也多了 24%。 Astra for Law 会先向部分美国律所开放,在 ChatGPT 和 Codex 中显示为 GPT-6 Astra Law,随后开放 API。Harvey、Legora 等法律 AI 公司也可以把它接进自己的产品。OpenAI 还推出 26 个法律行业插件,可以调用 Thomson Reuters、Relativity、Clio 等专业法律数据和工具。
GPT-6 Astra 发布一周后遭用户吐槽变笨,OpenAI 尚未回应
ChainCatcher 消息,据 Decrypt 报道,OpenAI 最新旗舰模型 GPT-6 Astra 在发布一周后,X 平台上涌现大量用户吐槽其性能“变笨”的帖子。匿名开发者 synthwavedd 发文称“Astra 今天感觉明显变笨了”,并调侃这是“发布后脑叶切除手术”。此前曾称赞该模型的开发者 Pranjal Paliwal 在检查 Astra 为其编写的代码后表示:“我们没有 AGI,我们遇到的是性能回退。”开发者 Pankaj Kumar 列举了症状:回答更快、质量更差,并怀疑 OpenAI 调低了“juice value”(即模型在回答前投入的算力)。Salio 与研究员 Md Ismail Sojal 用相同提示词对比发布当天与当前的 Astra,均得到更差的结果。T3Chat 创始人 Theo 则认为 Astra 只是比 Claude Fable 更不稳定,用户蜜月期结束后开始集中晒出糟糕结果。也有观点指出,OpenAI 上一代旗舰 GPT-5.6 Sol 在 7 月就经历过同样的周期,当时 OpenAI 高管 Tibo Sottiaux 否认故意削弱模型,但承认公司一直在实验“推理努力”设置。OpenAI 尚未就 Astra 发布类似 Sol 的声明。
OpenAI 应用研究负责人:八至九成研究聚焦 GPT-7 及以后
ChainCatcher 消息,X 用户 choblin29 发文称,OpenAI 应用研究负责人 Boris Power 表示,公司已有 80% 至 90% 的研究聚焦于 GPT-7、GPT-8 及后续模型。Power 认为,同一代模型内部的改进在内部被视为极短期投入,可用于加快当下学习,但并非长期策略。据该帖整理,相关路径是先构建大型前沿模型,再将其作为教师模型,蒸馏为更小、更便宜的模型。Power 提到,GPT-6 Astra 可被蒸馏为 Luna 等模型,并认为构建小型专用模型的较好方式,可能是先训练能力更强的通用模型。他还称,当前最大问题并非模型性能,多数用户仍不了解现有 AI 已经能够完成的工作。
OpenAI 发布 GPT-6 Sol 与 Luna,API 价格下调 50%
ChainCatcher 消息,OpenAI 于 9 月 22 日发布 GPT-6 Sol 与 GPT-6 Luna 两款新模型,发布时间距 Anthropic 推出 Claude Opus 5.5 仅数分钟。两款模型定位低于 GPT-6 Astra,是面向日常工作的更便宜、更快速选项。OpenAI 同时将两款模型的 API 价格较 GPT-5.6 促销价下调 50%,Sol 输入与输出价格分别为每百万 token 2 美元与 10 美元,Luna 则降至 0.1 美元与 0.5 美元。性能方面,OpenAI 援引 Zapier 的 AutomationBench 基准称,GPT-6 Sol 在最高推理设置下得分为 33.2%,每任务成本 0.27 美元,而 Claude Opus 5 最高设置为 26.9%,每任务成本高出逾 11 倍。在 Agents' Last Exam 测试中,GPT-6 Sol 最高得分 56.4%。在 OSWorld 2 计算机使用测试中,GPT-6 Sol 以 60.5% 对 60.3% 几乎追平 Claude Opus 5 的中等努力得分,成本低约 80%。
OpenAI加速清旧模型,GPT-5.5上线不到半年就退场
动察 Beating AI 快讯,OpenAI 宣布,10 月 14 日起,GPT-5.5 将从 ChatGPT、ChatGPT Work 和使用 ChatGPT 账号登录的 Codex 中下线,所有套餐都受影响。Codex 用户需要改用 GPT-5.6 Sol 或 GPT-6 Astra。 GPT-5.5 今年 4 月 23 日才发布,从发布到计划下线只有 174 天。当时 OpenAI 还把它定位为面向复杂工作和编程的旗舰模型。随着 GPT-5.6 Sol 和 GPT-6 Astra 上线,5.5 很快就进入了上一代模型名单。 不过这次并不是彻底停服。OpenAI API 仍会继续提供 GPT-5.5,使用 API Key 的 Codex 会话也不受这次下线影响。OpenAI 开发者论坛已经有用户要求保留 5.5 的 Codex 入口,称它在自己的生产编码流程里依然更稳定、返工更少。