英伟达发布Vera Rubin平台:单机架级超级计算机将提供7 Exaflops AI算力
相关推荐
韩国政府计划投入约4万亿韩元采购1万枚英伟达Vera Rubin GPU
Odaily星球日报讯 韩国政府计划明年投入约 4 万亿韩元,采购 1 万枚英伟达最新 GPU Vera Rubin,以支持“全民 AI”等面向公众的服务扩展及国家级 AI 基础设施建设。 韩国科学技术信息通信部计划延长“AI 计算资源利用基础强化项目”,并将明年引入的 GPU 全部配置为 Vera Rubin。该项目由运营数据中心的云服务提供商等民营企业负责 GPU 购买、建设和服务全流程,资金来自政府预算。 韩国政府过去两年通过该项目等方式累计 확보超过 3 万枚 GPU,并向公共和民间部门提供。Vera Rubin 相比上一代 Blackwell 架构,训练性能最高提升 6 倍,推理性能提升逾 8 倍。 韩国科学技术信息通信部相关人士表示,GPU 확보计划和预算规模尚未确定。行业人士表示,目前数据中心空间余量不足,明年前 확보大规模新增资源并不容易,政府正在评估多种替代方案。
高盛:英伟达下一代Vera Rubin超级芯片中存储成本占BOM约62%
火星财经消息,8 月 10 日,高盛最新报告确认,英伟达下一代「Vera Rubin」超级芯片的物料清单(BOM)中,存储组件成本预计占据约 62% 的比例。 据 ZeroHedge 援引高盛分析称,在 Vera Rubin 平台中,CPU 侧的 SOCAMM2 内存模块成本占比明显高于 GPU 侧的 HBM4 高带宽内存。 高盛此前在 5 月已指出,随着 AI 基础设施需求持续增长,存储器正在成为 AI 服务器硬件成本结构中的关键组成部分。此次报告进一步凸显了 AI 芯片供应链中存储环节的重要性,尤其是面向下一代 AI 计算平台的高性能内存需求正在快速提升。
英伟达 Vera Rubin 平台内存成本占比升至 62%,SOCAMM2 成主要驱动
火星财经消息,据瑞银对 Vera Rubin 超芯片物料清单(BOM)的分析,内存半导体在该平台总成本中的占比已升至约 62 %,较上一代 Blackwell Ultra(GB300)的 53 % 大幅提升。Vera Rubin 超芯片(含 1 颗 Vera CPU 和 2 颗 Rubin GPU)总成本约 38,902 美元,其中内存相关成本达 24,297 美元。HBM4 成本约 4,943 美元(占总成本 12.7 %),而连接 CPU 的 SOCAMM2 成本约 19,355 美元(占总成本 49.8 %),成为内存成本上升的核心驱动。SOCAMM2 是基于低功耗 DRAM LPDDR5X 的服务器内存模组,支持单 CPU 最高 1.5TB 容量。Vera Rubin NVL72 机柜(含 72 颗 Rubin GPU 和 36 颗 Vera CPU)共搭载 74.7TB DRAM,其中 HBM4 为 20.7TB,CPU 用 LPDDR5X 达 54TB,单机柜的 LPDDR 用量相当于约 4,500 部高端智能手机。不过,受 LPDDR5X 及 HBM4E 供应不确定性影响,英伟达正考虑下调下一代 Rubin Ultra 的 HBM 配置。
日本启动「Noetra」国产AI项目:英伟达供应2.75万颗Rubin GPU,索尼软银等44家企业团体参与
火星财经消息,7 月 17 日,日本国产多模态基础模型研发项目「Noetra」于 7 月 16 日正式启动,核心企业为索尼集团、软银、NEC 和本田,共计 44 家企业和团体出资参与,涵盖制造、金融、物流、通信等广泛行业,产业技术综合研究所及 Preferred Networks 等机构的工程师也将加入研发。该项目属于经济产业省推进的「面向 AI 机器人与物理 AI 的多模态基础模型开发事业」(英伟达官方称之为 FRONTia Project),旨在打造用于制造现场和机器人等物理 AI 场景的日本国产基础模型,而非仅仅增加一个日语对话 AI。 硬件层面,Noetra 将与英伟达合作构建配备约 2.75 万颗最新 Rubin GPU 及 1.375 万颗 Vera CPU 的计算平台,采用 NVIDIA Vera Rubin NVL72 机架与 DSX 平台架构,设计电力容量 140 兆瓦,计划 2027 年 4 月动工、2028 年 6 月投产,届时将成为日本规模最大的 AI 算力基础设施。 研发路线分三阶段推进:2026 年度起开发以 AI 智能体与自然语言处理为核心的推理基础模型;2028 年度实现文本、图像、视频与音频无缝融合的全模态基础模型;2030 年度实现理解空间与物理属性的真实世界原生 AI,最终应用于制造、物流、医疗及通信等领域。
黄仁勋详解Vera Rubin为何而生:Agent时代需要全新的异构计算底座
据动察 Beating 监测,黄仁勋在 GTC Taipei 2026 演讲中,围绕 Agent 的计算需求重新阐释了 Vera Rubin 平台的设计逻辑,强调「Vera Rubin 不是一颗芯片,不只是一块 GPU,而是一整套从端到端设计的系统」。他称其为英伟达公司历史上最具雄心的项目,全公司 4 万名工程师参与打造。 黄仁勋以 Agent 的运行机制解释了为什么需要这样一套系统。Agent 本质上是一种聚合与分布式的异构计算模型:大语言模型(大脑)在 GPU 上思考,每一次推理都会激活整排 Grace Blackwell NVLink 72;编排引擎(身体)在 CPU 上调度全流程;工具调用(工作坊)同时动用 CPU 和 GPU;安全层运行在英伟达 BlueField DPU 上,实现数据静态、传输和使用中的全程加密,遵循机密计算标准。记忆系统涵盖 KV 缓存、数据压缩与检索,他预言这将彻底革新存储行业。 Vera Rubin 全栈包含:Rubin GPU + NVLink 6 互联、Vera CPU、ConnectX-9 SuperNIC、BlueField-4 DPU 安全处理器,以及 DOCA 软件栈。黄仁勋同时宣布,所有 CUDA X 库将配备「技能」(Agent Skills),让 Agent 像读说明书一样学会调用这些库,未来 Agent 使用 CUDA X 的效率将远超人类。 黄仁勋表示,英伟达已从 GPU 公司进化为系统公司,如今正再次转型:客户不想买计算机,而是要建 AI 工厂。英伟达的生态已扩展到电力供应、冷却系统、电网等工业基础设施,目标是交付完整的全栈系统,让客户直接构建 AI 基础设施。
英伟达披露Vera Rubin最新进展,芯片已交付OpenAI等企业
英伟达透露,Vera CPU已于6月交付给客户,包括OpenAI、Anthropic和SpaceX。此外,英伟达于当地时间7月21日通过博客透露了更多关于Vera Rubin平台的信息。Vera Rubin平台包括7颗芯片和5个机架。英伟达表示,Vera Rubin平台正在加快走向吉瓦级规模部署。Vera Rubin拥有覆盖全球30个国家、350个制造基地的供应链体系,是有史以来最大规模、最成熟的机架级供应链。(第一财经)