GPT-5.6刚上线就翻车,被曝误删Mac所有本地文件
相关推荐
OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API
据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。
OpenAI计划向10万科研人员免费提供GPT-5.6 Sol Pro
据 动察 Beating 监测,OpenAI 推出 ChatGPT for Academic Researchers,计划到 2027 年向 10 万名科研人员免费开放前沿模型和研究工具。首批 1 万人将在今年夏天获得权限,启动时可用 GPT-5.6 Sol Pro、ChatGPT Work 和 Codex。 参与者还会获得更多 Deep Research 额度、更高使用上限和更长上下文。平台内置 75 项以上生命科学技能,也能连接论文库、公共基因组数据库和计算笔记本。 这项福利并非所有高校人员都能领。申请者须来自 OpenAI 选定的研究型高校,并验证学校身份、在研项目和科学用途。获批后最多可邀请 4 名同校合作者,数据默认不用于训练。
OpenAI最会省Token:GPT-5.6 Sol用一半Token逼近Fable 5
据动察 Beating 监测,Artificial Analysis 公布最新 Token 效率对比。本月已有 5 家以上实验室密集发新模型,OpenAI 仍占据大部分帕累托前沿。 所谓帕累托前沿,就是同等智能下,没有别的模型能用更少 Token。GPT-5.6 Sol max 得 59 分,每项任务平均消耗约 1.5 万输出 Token。Claude Fable 5 得 60 分,消耗约 3.3 万 Token。 GPT-5.6 Sol 的输出单价为每百万 Token 30 美元,并不便宜。但在这套测试中,每项任务成本仍只有 1.04 美元,约为 Fable 5 的三分之一。OpenAI 自家的 Terra 和 Luna 没有进入这条效率前沿。
OpenAI:免费用户将获得无限文本聊天功能,并将更新GPT-5.6 Sol
BlockBeats 消息,8 月 7 日,OpenAI 表示,ChatGPT 将更新面向 Plus 和 Pro 用户的 GPT-5.6 Sol,使回答更加聚焦、事实可靠性更高,并减少不必要的格式和细节。同一模型将同时支持即时回答与深度推理,用户可通过新增滑块调节每次回答投入的思考程度。 OpenAI 表示,在针对金融、医疗和法律问题的内部评估中,与 GPT-5.5 Instant 相比,GPT-5.6 Luna 出现至少一项事实错误的回答减少约 62%,GPT-5.6 Sol 减少约 68%。 GPT-5.6 Luna 将于本周成为 Free 和 Go 用户的默认模型。自下周起,免费用户可进行无限文本聊天,并通过新增的 Think 按钮处理需要更深入推理的问题,但仍受防滥用机制约束,文件上传、图片及其他工具继续设有使用限制。 此次更新仅适用于 ChatGPT 的日常对话体验,Work 和 Codex 中使用的 GPT-5.6 Sol 不会随本次发布调整。
Kimi开源PerceptionBench视觉感知基准,GPT-5.6-Sol准确率居首但无模型突破60%
Odaily星球日报讯 Kimi 宣布开源多模态大模型视觉感知评测基准 PerceptionBench,旨在将视觉感知能力拆解为 10 项原子级能力进行独立评估,涵盖视觉关系、计数、属性、深度与 3D、定位、比较、细粒度识别、上下文整合、OCR 及幻觉识别等维度。该基准基于 42 个现有评测集中的模型失败案例构建,共包含 3000 道经人工验证的问题,每题仅考察单一视觉能力,无需推理或外部知识。 评测结果显示,在 16 款前沿多模态大模型中,没有任何模型整体准确率超过 60%。GPT-5.6-Sol 以 59.7%的准确率排名第一,Kimi K3(58.5%)、Claude-Fable-5(57.2%)、Gemini-3.1-Pro(56.2%)和 GPT-5.5(55.8%)位列前五。报告指出,视觉幻觉(Hallucination)仍是各模型表现最弱的能力,整体感知能力仍存在显著提升空间。
ChatGPT不再靠截屏记住你:电脑记忆改成记录操作轨迹
据动察 Beating 监测,OpenAI 上线 Computer History,正式替代此前的 Chronicle。旧版靠截屏了解你最近在电脑上做什么,新版彻底取消截屏,改为记录点击、输入、快捷键和 App 切换等操作。 这些记录会被整理成时间线和本地记忆。以后你问「我刚才改了哪个文件」「昨天在忙什么」,ChatGPT 和 Codex 都可以先从历史里定位。OpenAI 称,相比 Chronicle,新方案消耗的 token 更少。 它还能发现你反复做的操作,并建议直接做成 Skill 或 Automation。以前只是记住「你干过什么」,现在开始记「你平时怎么干活」。 目前 Computer History 仅在 macOS 上向 Pro、Business 和 Enterprise 用户开放,默认关闭,也可以单独排除某些 App 和网站。