OpenAI CEO:GPT-6 Astra让每个人拥有天才级员工,AI时代迎来「创意人士的复仇」
相关推荐
GPT-6 Astra全量上线:OpenAI连送两次额度重置
动察 Beating AI 快讯,OpenAI 已将 GPT-6 Astra 向 Plus、Pro 和 Business 用户全量开放。昨天 Astra 还处在分批推送阶段,很多 Pro 用户也用不了;今天 Plus 和 Pro 用户都已经可以在 ChatGPT Work 和 Codex 中使用。核心产品负责人 Thibault Sottiaux 称,团队的系统扩展能力比预想更强,因此很快完成了这轮全量上线。 Astra 首发时只给少量企业客户。OpenAI 原本预计要用几天逐步开放。大量付费用户迟迟拿不到后,Sam Altman 还为这次「混乱的发布」道歉。现在团队称系统扩展能力比预想更好,因此提前把 Plus 也发完了。 原本承诺的补偿也照发。符合条件的现有 Plus、Pro 和 Business 用户,9 月 3 日和 4 日各能拿一次 banked reset。它相当于一张可以以后手动使用的 Codex 满额重置券,会刷新 5 小时和周额度。北京时间 9 月 5 日 11:00 前新开账号或升级套餐,也能拿到这次重置。 Plus 虽然能用 Astra,但额度不算宽裕。OpenAI 当前估算,Plus 每 5 小时大约可跑 5–45 条 Astra 本地消息,GPT-5.6 Sol 则是 10–100 条。实际消耗取决于任务长度、推理强度和工具调用。
GPT-6 Astra即将发布:OpenAI官方仓库已出现GPT-6
动察 Beating AI 快讯,OpenAI 官方的 GitHub 仓库里,已经直接出现了 GPT-6。一名 OpenAI 开发者向 Computer Use 示例项目提交 PR,新增 gpt6-js-image 和 gpt6-py-image 两套环境,分支名也直接叫 codex/gpt6-computer-use-images。 这两套环境分别面向 JavaScript 和 Python。前者装好 Playwright 和 Chromium,后者则用 PyAutoGUI、Chromium 和 Linux 桌面环境,让 Agent 可以看屏幕、操作浏览器和桌面。PR 目前还没有合并,而且里面没有 GPT-6 的 API 调用,只是在准备 Computer Use 的运行环境。 Sam Altman 最近在采访中称,过去的模型操作电脑一直太慢或者不好用,但 Astra 让他第一次感觉「已经达到和人类差不多的水平」。他现在会直接让模型去不同应用里找消息,而不是自己一个个打开搜索。
Sam Altman确认OpenAI今年不上市:AI安全问题让现在IPO「时机不当」
动察 Beating AI 快讯,OpenAI CEO Sam Altman 在接受《财富》专访时确认,公司不会在 2026 年进行 IPO,并称考虑到当前 AI 安全形势,现在上市「时机不当」。 Altman 表示,OpenAI 并不急于上市,未来将在业务准备就绪、社会能够适应不同能力水平的 AI 模型后再考虑 IPO。他还称,公司需要优先解决 AI 安全与对齐问题,并可能在 AI 能力达到新的阶段时放缓前沿模型开发。此前有报道称,OpenAI 曾考虑将 IPO 推迟至 2027 年,潜在估值或达 1 万亿美元。 与此同时,Anthropic CEO Dario Amodei 近期也呼吁放缓前沿 AI 发展,并提出让独立评估机构获得公司内部员工级别的访问权限。随后 Sam Altman 表示,「我同意 Dario Amodei(Anthropic CEO)的看法,我们需要控制前沿模型的进展。这是我们最近在 OpenAI 讨论的主要话题。承诺让独立评估者拥有类似员工的访问权限是个好主意,我们也会这样做。我们很快会有更多消息分享。」
GPT-6 Astra 发布一周后遭用户吐槽变笨,OpenAI 尚未回应
ChainCatcher 消息,据 Decrypt 报道,OpenAI 最新旗舰模型 GPT-6 Astra 在发布一周后,X 平台上涌现大量用户吐槽其性能“变笨”的帖子。匿名开发者 synthwavedd 发文称“Astra 今天感觉明显变笨了”,并调侃这是“发布后脑叶切除手术”。此前曾称赞该模型的开发者 Pranjal Paliwal 在检查 Astra 为其编写的代码后表示:“我们没有 AGI,我们遇到的是性能回退。”开发者 Pankaj Kumar 列举了症状:回答更快、质量更差,并怀疑 OpenAI 调低了“juice value”(即模型在回答前投入的算力)。Salio 与研究员 Md Ismail Sojal 用相同提示词对比发布当天与当前的 Astra,均得到更差的结果。T3Chat 创始人 Theo 则认为 Astra 只是比 Claude Fable 更不稳定,用户蜜月期结束后开始集中晒出糟糕结果。也有观点指出,OpenAI 上一代旗舰 GPT-5.6 Sol 在 7 月就经历过同样的周期,当时 OpenAI 高管 Tibo Sottiaux 否认故意削弱模型,但承认公司一直在实验“推理努力”设置。OpenAI 尚未就 Astra 发布类似 Sol 的声明。
OpenAI更新GPT-6 Astra界面,补充模型性能及API定价等信息
Odaily星球日报讯 OpenAI 最新更新 GPT-6 Astra 产品页面,补充了模型性能、企业应用、安全能力及 API 定价等信息。Astra 在 ARC-AGI-3 取得 99.9%,FrontierMath Tier 4 约 97.6%,Terminal-Bench 4.0 达 57.9%,高于 GPT-5.6 Sol 的 37.3%,并略高于 Claude Fable 5.1 的 55.8%;专业任务 Agents’ Last Exam 得分 59.3%,也高于 Claude Opus 5 的 55.5%。 OpenAI 同时明确,Astra 未来数日将陆续开放给 Plus、Pro、Business 和 Enterprise 用户,并进入 API、Azure 和 AWS Bedrock。由此看,产品页此次更新很可能是在为更大范围开放做准备,但具体全面上线时间仍未公布。
OpenAI被曝悄然调整GPT-6 Astra评测数据,部分指标曾“逆势”优化
PANews 9月5日,据《财富》报道,OpenAI已正式发布GPT-6 Astra,并称其为“目前全球最智能、且对齐程度最高的模型”,不过OpenAI已多次调整模型评测数据,部分调整使Astra表现更佳,同时部分竞争对手模型的成绩出现下降。其中,Astra的内部“幻觉率”最初公布为4.2%,后曾被下调至2%,随后又恢复至4.2%;Anthropic的Fable 5.1在FrontierMath Tier 4中的成绩也曾从87.8%降至78%,目前已恢复至83%。此外,Astra的ARC-AGI-3成绩则从发布前的98.6%提升至当前页面显示的99.99%。