印度AI公司AMI订购9000颗英伟达Rubin GPU 建30MW算力集群
相关推荐
英伟达考虑降低Rubin Ultra GPU配置,以缓解HBM供应短缺
PANews 8月7日消息,据The Information报道,英伟达正在考虑调整下一代Rubin Ultra GPU的设计方案,通过减少高带宽内存(HBM)配置来应对先进HBM芯片供应紧张问题。 知情人士透露,过去几周英伟达已测试至少三种不同版本的Rubin Ultra GPU,其中部分版本搭载的显存容量低于公司此前公布的规划。英伟达考虑推出低显存版本,主要原因是市场可能无法获得足够数量的先进HBM芯片。 HBM是AI加速器的关键组件,能够提供更高的数据传输速度,成为训练和推理大型AI模型的重要基础。随着AI算力需求快速增长,HBM供应已成为限制高端AI芯片产能的重要因素之一。
美股盘前要闻一览:光通信、存储板块盘前大涨;全球最小GPU芯片通过实测;机构称英伟达评估下调Rubin Ultra平台的HBM配置
火星财经消息,投资者需重点关注的美股市场财经要闻如下:1、美三大股指期货集体上行。道琼斯指数期货涨1.25%,标普500指数期货涨0.35%,纳斯达克100指数期货涨1.11%。2、国际油价集体下挫。WTI原油期货价格跌3.33%,报77.663美元/桶;布伦特原油期货价格跌2.57%,报81.621美元/桶。消息面上,美财长贝森特称,美国可能明日与伊朗达成协议以开放霍尔木兹海峡。3、国际金银现货集体走高。现货黄金价格涨0.43%,报4072.67美元/盎司;现货白银价格涨2.72%,报59.74美元/盎司。4、欧洲三大股指集体上涨。英国富时100指数涨0.34%,法国CAC40指数涨0.32%,德国DAX30指数涨0.82%。5、美股光通信板块盘前大幅拉升,Coherent涨超13%,Lumentum涨超12%,康宁、迈威尔科技涨近8%。存储股普涨,闪迪涨超5%,美光科技、SK海力士涨超4%。6、AI应用股Palantir盘前大涨15%。公司二季度营收19.4亿美元,高于市场预期,并上调全年营收指引至81.5亿-81.6亿美元。7、全球最小GPU芯片TinyGPU v2.0据悉通过实机测试。该芯片约有24万个晶体管,具备4-bit双缓冲,以及存储在QSPI RAM中的8-bit深度缓冲。8、SpaceX正在设计其卫星系统,以适应由人工智能、机器学习和边缘计算驱动的数据需求的爆炸式增长,其目标是部署一个最多达一百万颗卫星的系统。与此同时,SpaceX将于今晚美股盘后交出其上市后的首份成绩单。9、集邦咨询表示,DRAM供不应求格局将延续至2027年,英伟达评估下调Rubin Ultra平台的HBM配置。部分云端服务供应商也正考虑调降下一代自研ASIC的HBM容量设计。10、马斯克7月单月身价缩水3630亿美元,这一缩水幅度超过了全球第2至第10大富豪中任何一人的全部身家。(财联社)
韩国政府计划投入约4万亿韩元采购1万枚英伟达Vera Rubin GPU
Odaily星球日报讯 韩国政府计划明年投入约 4 万亿韩元,采购 1 万枚英伟达最新 GPU Vera Rubin,以支持“全民 AI”等面向公众的服务扩展及国家级 AI 基础设施建设。 韩国科学技术信息通信部计划延长“AI 计算资源利用基础强化项目”,并将明年引入的 GPU 全部配置为 Vera Rubin。该项目由运营数据中心的云服务提供商等民营企业负责 GPU 购买、建设和服务全流程,资金来自政府预算。 韩国政府过去两年通过该项目等方式累计 확보超过 3 万枚 GPU,并向公共和民间部门提供。Vera Rubin 相比上一代 Blackwell 架构,训练性能最高提升 6 倍,推理性能提升逾 8 倍。 韩国科学技术信息通信部相关人士表示,GPU 확보计划和预算规模尚未确定。行业人士表示,目前数据中心空间余量不足,明年前 확보大规模新增资源并不容易,政府正在评估多种替代方案。
日本启动「Noetra」国产AI项目:英伟达供应2.75万颗Rubin GPU,索尼软银等44家企业团体参与
火星财经消息,7 月 17 日,日本国产多模态基础模型研发项目「Noetra」于 7 月 16 日正式启动,核心企业为索尼集团、软银、NEC 和本田,共计 44 家企业和团体出资参与,涵盖制造、金融、物流、通信等广泛行业,产业技术综合研究所及 Preferred Networks 等机构的工程师也将加入研发。该项目属于经济产业省推进的「面向 AI 机器人与物理 AI 的多模态基础模型开发事业」(英伟达官方称之为 FRONTia Project),旨在打造用于制造现场和机器人等物理 AI 场景的日本国产基础模型,而非仅仅增加一个日语对话 AI。 硬件层面,Noetra 将与英伟达合作构建配备约 2.75 万颗最新 Rubin GPU 及 1.375 万颗 Vera CPU 的计算平台,采用 NVIDIA Vera Rubin NVL72 机架与 DSX 平台架构,设计电力容量 140 兆瓦,计划 2027 年 4 月动工、2028 年 6 月投产,届时将成为日本规模最大的 AI 算力基础设施。 研发路线分三阶段推进:2026 年度起开发以 AI 智能体与自然语言处理为核心的推理基础模型;2028 年度实现文本、图像、视频与音频无缝融合的全模态基础模型;2030 年度实现理解空间与物理属性的真实世界原生 AI,最终应用于制造、物流、医疗及通信等领域。
LG CNS将斥资3814亿韩元采购英伟达GPU及基础设施设备
9月11日,一份监管文件显示,韩国LG集团旗下的专业IT服务与系统集成企业LG CNS计划采购价值3,814亿韩元的GPU及基础设施设备。采购设备包括英伟达Vera Rubin GPU,将用于建设AI工厂。(界面)
韩国为英伟达 Vera Rubin 机架预算每台 275 亿韩元
火星财经消息,据 Money Today 报道,韩国政府将于明年引入的英伟达下一代 AI 芯片 Vera Rubin 预算定为每台机架 275 亿韩元,高于外媒此前预估。科学与信息通信部明年 GPU 服务器扩容预算为 3.85 万亿韩元,全部用于采购 140 台 Vera Rubin NVL72 服务器机架。每台 NVL72 机架配备 72 颗 Rubin GPU 与 36 颗 Vera CPU,合计可获得 10080 张 Rubin GPU,该批次独立于该部此前宣布至 2028 年获取的 5.2 万张先进 GPU,实际供应量可能随英伟达供货情况调整。每台机架 275 亿韩元明显高于外媒预测。美国投行 Bernstein 6 月报告将 Vera Rubin NVL72 机架成本估为 910 万美元(约 123 亿韩元),摩根士丹利估为约 780 万美元(约 105 亿韩元)。政府方面称,预算已考虑 GPU 短缺可能带来的涨价及配套设施成本。该批芯片将用于通用人工智能等下一代前沿模型开发。副总理兼科学与信息通信部长官裴庆勋曾于 6 月表示,打造与 Anthropic 超大模型 Mythos 同级的模型约需 1 万张 Vera Rubin,此次 140 台规模与之相当。