分析:Anthropic订阅套餐性价比约为OpenAI的5倍
相关推荐
OpenAI 28天冲刺首日:GPT-6 Astra和6.1 Sol提速约50%
动察 Beating AI 快讯,OpenAI 产品与平台主管 Thibault Sottiaux 公布 28 天产品冲刺的首日更新。GPT-6 Astra 和 GPT-6.1 Sol 的默认生成速度已经优化,官方称整体约提升 50%。 这次提速不仅覆盖 Codex 和 ChatGPT Work。通过「Sign in with ChatGPT」使用 ChatGPT 订阅额度的第三方产品也会同步生效,包括 OpenCode、Pi、Amp 和 Devin 等。用户不需要修改任何设置,更新会自动推送。 OpenAI 此前承诺,未来 28 天每天要么交付一项对多数 Codex / Work 用户有明确改善的更新,要么直接重置用户额度。这次提速就是 Day 1。
OpenAI 推出 GPT-6.1 Sol 模型,性能接近 Astra
ChainCatcher 消息,OpenAI 推出 GPT-6.1 Sol 模型,其性能接近 Astra,但标准词元价格仅为 Astra 的五分之一。
Anthropic 发布 Claude Sonnet 5.5,编程成绩超过 Opus 5.5
ChainCatcher 消息,Anthropic 于本周一发布 Claude Sonnet 5.5,作为今年 6 月推出的 Sonnet 5 的升级版本。官方称该中端模型运行速度较上一代提升超过 30%,在范围明确的日常任务、修复缺陷以及制作文档、幻灯片和表格方面表现最强,同时具备敏锐的设计能力。其定价维持每百万输入 token 2 美元、每百万输出 token 10 美元,为 Opus 5.5 的一半,且每个任务消耗的 token 较 Sonnet 5 减少近三分之一。在 Terminal-Bench 4 测试中,Sonnet 5.5 得分 70.6%,高于 Opus 5.5 的 66.4%,Sonnet 5 仅为 10.3%。独立测试机构 Artificial Analysis 的结果同样显示其领先,分别录得 63.6% 与 59.6%,OpenAI 的 GPT-6 Astra 为 59.1%。在评估 44 类职业真实工作表现的 GDPval-AA 上,Sonnet 5.5 获 1844 分,与 Opus 5.5 的 1846 分基本持平,GPT-6 Sol 为 1487 分。
OpenAI修复GPT-6图像Bug,Luna视觉定位翻倍
动察 Beating AI 快讯,OpenAI 修复了 GPT-6 Sol 和 GPT-6 Luna 的一个图像编码 Bug。这个问题会降低模型对图片的理解能力,修复后 API 和 Codex 的视觉任务都会改善,包括让 Agent 看屏幕操作电脑的 Computer Use。 OpenAI 公布的测试中,GPT-6 Luna(Max)在 RefCOCOg 视觉定位评测上的平均 IoU 从 28.8% 升到 60.0%,提高 31.2 个百分点。这个测试主要看模型能不能根据一句描述,在图片里准确找到对应的物体或区域。 两款模型 9 月 22 日才正式上线 API,OpenAI 的更新日志在 9 月 25 日就记录了这次修复。官方没有公布 Sol 的具体提升,也没有说明 Bug 从什么时候开始、影响了多少图片请求。 OpenAI 还罕见地建议使用图片输入的开发者重新跑一遍评测,并重试此前受影响的工作流。
OpenAI与新思科技合作开发芯片设计AI模型GPT-Synopsys
PANews 10月1日消息,据官方公告,OpenAI与芯片设计软件(EDA)巨头新思科技(Synopsys)宣布达成多年合作,共同开发面向半导体设计的专用AI模型GPT-Synopsys。该模型可调用Synopsys的EDA工具,由AI代理围绕功耗、性能和面积等目标执行芯片设计、解读结果并迭代优化,运行于OpenAI托管的基础设施,客户设计数据不会用于模型训练。双方将采用收入分成模式,具体金额未披露,目前已与部分头部半导体客户开展早期合作。
美国联邦贸易委员会对Anthropic、OpenAI及其他超级智能模型展开全面调查
PANews 9月30日消息,据纽约邮报:美国联邦贸易委员会(FTC)对Anthropic、OpenAI及其他超级智能模型展开全面调查。