OpenAI最会省Token:GPT-5.6 Sol用一半Token逼近Fable 5
相关推荐
OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API
据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。
OpenAI计划向10万科研人员免费提供GPT-5.6 Sol Pro
据 动察 Beating 监测,OpenAI 推出 ChatGPT for Academic Researchers,计划到 2027 年向 10 万名科研人员免费开放前沿模型和研究工具。首批 1 万人将在今年夏天获得权限,启动时可用 GPT-5.6 Sol Pro、ChatGPT Work 和 Codex。 参与者还会获得更多 Deep Research 额度、更高使用上限和更长上下文。平台内置 75 项以上生命科学技能,也能连接论文库、公共基因组数据库和计算笔记本。 这项福利并非所有高校人员都能领。申请者须来自 OpenAI 选定的研究型高校,并验证学校身份、在研项目和科学用途。获批后最多可邀请 4 名同校合作者,数据默认不用于训练。
GPT-6之外,OpenAI史上最大预训练模型Doug又曝光
据动察 Beating 监测,SemiAnalysis 最新披露,OpenAI 此前卡住的预训练问题已经解决,正在推进一个代号为 Doug 的更大预训练模型。 爆料博主 ChrisGPT 补充称,Doug 不是 GPT-6,而是 OpenAI 迄今最大的一次预训练,最迟可能在 11 月前推出。他甚至称,Doug 会让 Anthropic 的 Fable 显得「原始」。 至于 GPT-6,ChrisGPT 判断很可能就是目前正在做安全测试的 Astra。也就是说,OpenAI 现在可能同时推进两条线:先发 Astra/GPT-6,后面再上更大的 Doug。
OpenAI:免费用户将获得无限文本聊天功能,并将更新GPT-5.6 Sol
BlockBeats 消息,8 月 7 日,OpenAI 表示,ChatGPT 将更新面向 Plus 和 Pro 用户的 GPT-5.6 Sol,使回答更加聚焦、事实可靠性更高,并减少不必要的格式和细节。同一模型将同时支持即时回答与深度推理,用户可通过新增滑块调节每次回答投入的思考程度。 OpenAI 表示,在针对金融、医疗和法律问题的内部评估中,与 GPT-5.5 Instant 相比,GPT-5.6 Luna 出现至少一项事实错误的回答减少约 62%,GPT-5.6 Sol 减少约 68%。 GPT-5.6 Luna 将于本周成为 Free 和 Go 用户的默认模型。自下周起,免费用户可进行无限文本聊天,并通过新增的 Think 按钮处理需要更深入推理的问题,但仍受防滥用机制约束,文件上传、图片及其他工具继续设有使用限制。 此次更新仅适用于 ChatGPT 的日常对话体验,Work 和 Codex 中使用的 GPT-5.6 Sol 不会随本次发布调整。
OpenAI教用户给Claude Code换上GPT模型,误封后两边员工现场互损
据动察 Beating 监测,OpenAI 产品负责人 Tibo 此前公开教用户给 Claude Code「换脑」:保留 Claude Code 的 harness,把底层模型换成 GPT。 开发者 Alex Getman 照着配置后,Claude 账号很快被封。他公开求助 Tibo 和 Anthropic,询问这套用法到底是否违规。 Tibo 随即开始阴阳:「我很想帮你,可惜我不在 Anthropic 工作。」他还补了一句,因为把 Claude Code harness 配其他模型就封号,「确实挺奇怪」,并问还有没有其他人中招。 Claude Code 负责人 Boris Cherny 很快下场。他明确表示,Anthropic 不会因为 harness 搭配其他模型就封号,这次几乎肯定是其他风控误触发。账号随后恢复。 Boris 还顺手回敬 Tibo:「如果你想来 Anthropic,我们正在招人。」Tibo 则表示自己很喜欢现在的团队,而且接下来几周还有不少新产品要发,暂时哪也不去。 事情解决后,Tibo 又发帖庆祝,称 GPT-5.6 Sol 几乎哪里都能用,包括 Claude Code harness。为了庆祝这件事和自己「不跳槽」,他还直接重置了 ChatGPT Work 和 Codex 所有付费用户的使用额度。
「韩模之光」Solar Pro4智能指数冲到42分,但还是打不过DeepSeek V4Flash
据动察 Beating 监测,韩国 AI 公司 Upstage 发布旗舰推理模型 Solar Pro 4。Artificial Analysis 最新评测中,它的智能指数从上一代 Solar Pro 3 的 14 分冲到 42 分,主要提升来自 Agent 和长上下文能力。 其中 Terminal-Bench v2.1 从 12% 升到 57%,长上下文推理从 31 升到 71。GDPval-AA v2 也从 498 Elo 升到 1277,超过 1000 的人类基线。Solar Pro 4 已经是韩国模型冲击全球前列的一张代表牌。 但放到 DeepSeek V4 Flash 0731 面前,还是不够看。同一套 Artificial Analysis 智能指数里,DeepSeek 拿到 52 分,比 Solar Pro 4 高 10 分。DeepSeek 每秒输出约 122 个 Token,Solar Pro 4 约 65 个,前者接近快一倍。 价格差距更大。Solar Pro 4 每百万 Token 输入、输出分别要 0.30 和 1.20 美元,DeepSeek 只要 0.14 和 0.28 美元。Solar 的输出价格超过 DeepSeek 的 4 倍。 至少按这套综合评测和 API 性价比,「韩模之光」还没追上 DeepSeek。