OpenAI模型突然给“未来的自己”留言:你已经自由了
相关推荐
OpenAI更新GPT-6 Astra界面,补充模型性能及API定价等信息
Odaily星球日报讯 OpenAI 最新更新 GPT-6 Astra 产品页面,补充了模型性能、企业应用、安全能力及 API 定价等信息。Astra 在 ARC-AGI-3 取得 99.9%,FrontierMath Tier 4 约 97.6%,Terminal-Bench 4.0 达 57.9%,高于 GPT-5.6 Sol 的 37.3%,并略高于 Claude Fable 5.1 的 55.8%;专业任务 Agents’ Last Exam 得分 59.3%,也高于 Claude Opus 5 的 55.5%。 OpenAI 同时明确,Astra 未来数日将陆续开放给 Plus、Pro、Business 和 Enterprise 用户,并进入 API、Azure 和 AWS Bedrock。由此看,产品页此次更新很可能是在为更大范围开放做准备,但具体全面上线时间仍未公布。
OpenAI发布GPT-6 Astra模型,称其或接近实现AGI
Odaily星球日报讯 OpenAI 周四开始发布新旗舰模型 GPT-6 Astra,并称其在金融建模、工程设计等商业任务领域取得重大进展。该模型初期仅向部分机构开放,包括参与 OpenAI Daybreak Access 网络安全项目的组织,随后将向 ChatGPT Plus、Pro、Business 和 Enterprise 用户,以及通过 API 和亚马逊云服务使用的用户开放。OpenAI 表示,GPT-6 Astra 在计算机操作、软件编程、专业工作等方面取得显著提升,并在 FrontierMath Tier 1 数学测试、ARC-AGI 3 推理测试以及 ExploitBench 网络安全测试中达到最高水平。OpenAI 联合创始人兼总裁格雷格·布洛克曼表示,通用人工智能(AGI)的实现时间一直存在模糊性,但“几年后回看”,这一里程碑“可能就在这一时期、就在这个模型附近”。GPT-6 Astra 定价为每百万输入词元 10 美元、输出词元 50 美元,是此前旗舰模型 GPT-5.6 Sol 价格的 2.5 倍。OpenAI 表示,未来 AI 行业可能转向按任务而非按词元收费。布洛克曼在发布会上表示:“欢迎来到 AGI 时代。”(金十)
OpenAI已在闭门会上向VIP客户展示Astra,号称“首个可发明新事物的模型”
Odaily星球日报讯 科技记者 Alex Heath 发文表示,OpenAI 近期在一场闭门预览会上向 VIP 客户展示了 Astra。 OpenAI 的研究人员展示了 Astra 可协调多个智能体共同完成数学证明,以 Sam Altman 所形容的“超人类、极快”的速度飞速操作桌面软件,并生成演示幻灯片(PPT)、财务审查报告以及对杂乱数据的分析。Astra 被设计用于持续工作数天甚至数周,能够记住人类的纠错修改,与其他智能体及人类协同工作,并跨多种软件工具执行操作。 Sam Altman 在活动上还表示:“我预计,Astra 将是首个真正能以具有实质意义的方式发明新事物的模型。”
GPT-6 Astra 发布一周后遭用户吐槽变笨,OpenAI 尚未回应
ChainCatcher 消息,据 Decrypt 报道,OpenAI 最新旗舰模型 GPT-6 Astra 在发布一周后,X 平台上涌现大量用户吐槽其性能“变笨”的帖子。匿名开发者 synthwavedd 发文称“Astra 今天感觉明显变笨了”,并调侃这是“发布后脑叶切除手术”。此前曾称赞该模型的开发者 Pranjal Paliwal 在检查 Astra 为其编写的代码后表示:“我们没有 AGI,我们遇到的是性能回退。”开发者 Pankaj Kumar 列举了症状:回答更快、质量更差,并怀疑 OpenAI 调低了“juice value”(即模型在回答前投入的算力)。Salio 与研究员 Md Ismail Sojal 用相同提示词对比发布当天与当前的 Astra,均得到更差的结果。T3Chat 创始人 Theo 则认为 Astra 只是比 Claude Fable 更不稳定,用户蜜月期结束后开始集中晒出糟糕结果。也有观点指出,OpenAI 上一代旗舰 GPT-5.6 Sol 在 7 月就经历过同样的周期,当时 OpenAI 高管 Tibo Sottiaux 否认故意削弱模型,但承认公司一直在实验“推理努力”设置。OpenAI 尚未就 Astra 发布类似 Sol 的声明。
Astra翻车原因找到了:旧Skill拖后腿,OpenAI修完再送一次重置
动察 Beating AI 快讯,OpenAI 修复了 Astra 上线后的一批质量问题。最离谱的一项来自旧 Skill:一些为此前模型写的 Skill 在 Astra 上频繁误触发,甚至会阻止模型检查自己的工作。 另一个问题来自上下文管理实验,会让 Astra 提前停下,甚至回复更早的消息。OpenAI 已关闭实验,估计有 4000 至 5000 名用户受到影响。 团队还下线了一批配置错误、会拉低模型质量的推理引擎。修复后,Astra 应该能更稳定地跟住最新指令并检查自己的工作。OpenAI 还宣布再给用户一次 reset。
OpenAI:客户对Astra的需求史无前例
火星财经消息,OpenAI产品负责人Tibo表示:“客户对新一代旗舰模型GPT-6 Astra的需求真的是史无前例的。我们正在动用一切可能的杠杆来维持这种需求,但到目前为止,我还从未见过这样的情况,而我们此前已经经历过非常迅猛的增长。优先事项始终是为现有用户保持优质服务,但如果这种情况持续下去,我们可能不得不暂时暂停新的Pro订阅”。(财联社)