返回 7*24 快讯
来源Blockbeats

OpenAI「辣椒芯」硬刚英伟达:AI推理性能最高快3.6倍,年底小规模部署

动察 Beating AI 快讯,OpenAI 公布自研 AI 推理芯片 Jalapeño(翻译为:墨西哥辣椒)最新测试结果称,该芯片在 InferenceX 基准测试中击败英伟达 GB200、GB300 超级芯片,在 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 1T 等模型上,每瓦 AI 工作量达到竞品的 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍。 OpenAI 表示,Jalapeño 采用与博通合作开发的 ASIC 架构,专为 AI 推理设计,旨在同时提升吞吐量和降低延迟。OpenAI 计划于今年年底小规模部署,2027 年扩大产量,并继续开发第二、第三代芯片。不过,公司强调不会完全取代英伟达等合作伙伴的芯片。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-11 05:14

DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一

动察 Beating AI 快讯,Artificial Analysis 完成 DeepSeek V4.1 Flash 独立测试,综合智能指数拿到 40 分。它已经超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这套第三方榜单,DeepSeek 还没夺回国产模型第一。 但价格差距非常夸张。V4.1 Flash 跑完一个 Intelligence Index 任务平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差约 7 倍。输出速度达到 197 Token/s,也远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。 Agent 依然是它最强的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 也拿到 84%。缺点是它特别能说,AA 测试中单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,吃掉了一部分价格优势。

09-11 07:34

OpenAI把ChatGPT实时语音开放API:每分钟5美分

动察 Beating AI 快讯,OpenAI 开放 GPT-Live-1 API,也就是 ChatGPT 目前使用的实时语音模型。它能同时听和说,直接理解语音、处理普通对话,也能应对插话、停顿和背景噪音。 遇到复杂推理或工具调用时,GPT-Live-1 可以把任务交给 GPT-6 Astra、Luna 或第三方模型,拿到结果后再继续和用户聊。开发者可以自己决定后端接什么模型。 相比传统的「语音转文字→大模型→文字转语音」,GPT-Live-1 减少了中间的模型交接,让实时对话更连贯。 GPT-Live-1 收费每分钟 0.05 美元,后端模型另算。

09-07 11:04

OpenAI CEO:GPT-6 Astra让每个人拥有天才级员工,AI时代迎来「创意人士的复仇」

动察 Beating AI 快讯,据 AXIOS 报道,OpenAI 首席执行官 Sam Altman 表示,当前时代正迎来「创意人士」的复仇——那些曾经令人厌烦、空有创业想法却缺乏技术能力去实现的有志创业者。 这就像说「我有一个很好的歌曲创意,只需要那个拿吉他的人帮我做出来」一样。「我以前确实觉得这很可笑,」Altman 在北卡罗来纳州教堂山表示,「但现在我们看到整整一代人以前所未有的速度迭代创意。创办小型或大型企业的经济逻辑已经被重新定义。」 民调显示多数美国人认为 AI 风险大于收益,数据中心问题已成为中期选举中两党共同的争议焦点。正试图在强烈反对声中推广 AI 的 Altman 希望提醒美国人,在诸多现实风险之中,AI 也意味着机会。「这将是世界上创办初创公司最好的时代,」Altman 近期表示。 Altman 表示,借助 OpenAI 强大的新模型 GPT-6 Astra,你可以有效地创办和运营一家小企业……任何想拥有公司的人,现在在每个专业领域都拥有天才级的员工。

09-05 02:34

GPT-6 Astra全量上线:OpenAI连送两次额度重置

动察 Beating AI 快讯,OpenAI 已将 GPT-6 Astra 向 Plus、Pro 和 Business 用户全量开放。昨天 Astra 还处在分批推送阶段,很多 Pro 用户也用不了;今天 Plus 和 Pro 用户都已经可以在 ChatGPT Work 和 Codex 中使用。核心产品负责人 Thibault Sottiaux 称,团队的系统扩展能力比预想更强,因此很快完成了这轮全量上线。 Astra 首发时只给少量企业客户。OpenAI 原本预计要用几天逐步开放。大量付费用户迟迟拿不到后,Sam Altman 还为这次「混乱的发布」道歉。现在团队称系统扩展能力比预想更好,因此提前把 Plus 也发完了。 原本承诺的补偿也照发。符合条件的现有 Plus、Pro 和 Business 用户,9 月 3 日和 4 日各能拿一次 banked reset。它相当于一张可以以后手动使用的 Codex 满额重置券,会刷新 5 小时和周额度。北京时间 9 月 5 日 11:00 前新开账号或升级套餐,也能拿到这次重置。 Plus 虽然能用 Astra,但额度不算宽裕。OpenAI 当前估算,Plus 每 5 小时大约可跑 5–45 条 Astra 本地消息,GPT-5.6 Sol 则是 10–100 条。实际消耗取决于任务长度、推理强度和工具调用。

09-03 08:18

GPT-6 Astra即将发布:OpenAI官方仓库已出现GPT-6

动察 Beating AI 快讯,OpenAI 官方的 GitHub 仓库里,已经直接出现了 GPT-6。一名 OpenAI 开发者向 Computer Use 示例项目提交 PR,新增 gpt6-js-image 和 gpt6-py-image 两套环境,分支名也直接叫 codex/gpt6-computer-use-images。 这两套环境分别面向 JavaScript 和 Python。前者装好 Playwright 和 Chromium,后者则用 PyAutoGUI、Chromium 和 Linux 桌面环境,让 Agent 可以看屏幕、操作浏览器和桌面。PR 目前还没有合并,而且里面没有 GPT-6 的 API 调用,只是在准备 Computer Use 的运行环境。 Sam Altman 最近在采访中称,过去的模型操作电脑一直太慢或者不好用,但 Astra 让他第一次感觉「已经达到和人类差不多的水平」。他现在会直接让模型去不同应用里找消息,而不是自己一个个打开搜索。

08-26 13:51

选GPT-5.6却给你5.5-mini,OpenAI承认是Bug

动察 Beating AI 快讯,最近 ChatGPT 付费用户发现,明明选了 GPT-5.6 Sol 的 Thinking 或 Pro,回答却突然变快、质量下降。有人抓取网络请求后发现,前端请求的是 GPT-5.6,服务器实际返回的却是 gpt-5-5-mini。 OpenAI ChatGPT 产品负责人 Adam Fry 现已确认,这是一个路由 Bug。约 3% 的 Pro 和 Thinking 请求被错误切到了 GPT-5.5-mini,目前已经修复。