英伟达发布开源量子校准模型Ising Calibration 1.5,支持单GPU部署
相关推荐
上海:围绕高性能计算芯片(GPU/NPU)、量子芯片(QPU)、高速光互连(CPO)、高带宽内存(HBM)及异构服务器等核心环节 推动自主芯片与主流大模型深度融合
火星财经消息,上海市经济和信息化委员会印发《上海市软件和信息服务业发展“十五五”规划》。其中提到,攻坚下一代模型架构,推动基于状态空间模型、循环神经网络变体、液态神经网络等非Transformer架构的多技术路线探索。加快布局物理智能、世界模型、量子智能、类脑智能等前沿基础模型技术体系。攻关超大规模智能算力集群组网技术,围绕高性能计算芯片(GPU/NPU)、量子芯片(QPU)、高速光互连(CPO)、高带宽内存(HBM)及异构服务器等核心环节,提升智算硬件的供给能力,推动自主芯片与主流大模型深度融合。聚焦新型存储检索、数模协同等,突破高精度异构处理、原生多模态融合及动态价值对齐等关键技术,建设覆盖语料全生命周期的自动化复杂推理。(财联社)
预测市场Kalshi推出GPU价格预测市场,覆盖Nvidia B200、H200和A100芯片
火星财经消息,7 月 15 日,预测市场 Kalshi 宣布推出 GPU 计算前向曲线,覆盖 Nvidia B200、H200 和 A100 芯片,提供市场预期的未来计算价格预测。
B3 Labs推出GPU算力平台B3IQ,用户可分期购置专属服务器并出租闲置算力
火星财经消息,8 月 12 日,据官方消息,由 Coinbase 前团队成员创立的 B3 Labs 宣布推出 AI 基础设施平台 B3IQ。用户可分期购置专属 NVIDIA GPU 服务器。机器由 B3 Labs 投资的美国 AI 系统制造商 Andromeda 在美国组装、托管于俄勒冈州数据中心;设备闲置时可将算力出租给网络,收益可抵扣购机余款或留作收入。 斯坦福、纽约大学、达特茅斯等高校的研究团队已在使用该平台进行癌症研究与专用模型训练。B3IQ 正计划快速扩充美国本土组装的 NVIDIA GPU 系统库存,以满足增长的需求。
英伟达考虑降低Rubin Ultra GPU配置,以缓解HBM供应短缺
PANews 8月7日消息,据The Information报道,英伟达正在考虑调整下一代Rubin Ultra GPU的设计方案,通过减少高带宽内存(HBM)配置来应对先进HBM芯片供应紧张问题。 知情人士透露,过去几周英伟达已测试至少三种不同版本的Rubin Ultra GPU,其中部分版本搭载的显存容量低于公司此前公布的规划。英伟达考虑推出低显存版本,主要原因是市场可能无法获得足够数量的先进HBM芯片。 HBM是AI加速器的关键组件,能够提供更高的数据传输速度,成为训练和推理大型AI模型的重要基础。随着AI算力需求快速增长,HBM供应已成为限制高端AI芯片产能的重要因素之一。
AI云计算公司Corvex签署多年协议,提供英伟达Blackwell GPU
PANews 8月4日消息,据市场消息:AI云计算公司Corvex签署多年协议,提供英伟达Blackwell GPU。
日本启动「Noetra」国产AI项目:英伟达供应2.75万颗Rubin GPU,索尼软银等44家企业团体参与
火星财经消息,7 月 17 日,日本国产多模态基础模型研发项目「Noetra」于 7 月 16 日正式启动,核心企业为索尼集团、软银、NEC 和本田,共计 44 家企业和团体出资参与,涵盖制造、金融、物流、通信等广泛行业,产业技术综合研究所及 Preferred Networks 等机构的工程师也将加入研发。该项目属于经济产业省推进的「面向 AI 机器人与物理 AI 的多模态基础模型开发事业」(英伟达官方称之为 FRONTia Project),旨在打造用于制造现场和机器人等物理 AI 场景的日本国产基础模型,而非仅仅增加一个日语对话 AI。 硬件层面,Noetra 将与英伟达合作构建配备约 2.75 万颗最新 Rubin GPU 及 1.375 万颗 Vera CPU 的计算平台,采用 NVIDIA Vera Rubin NVL72 机架与 DSX 平台架构,设计电力容量 140 兆瓦,计划 2027 年 4 月动工、2028 年 6 月投产,届时将成为日本规模最大的 AI 算力基础设施。 研发路线分三阶段推进:2026 年度起开发以 AI 智能体与自然语言处理为核心的推理基础模型;2028 年度实现文本、图像、视频与音频无缝融合的全模态基础模型;2030 年度实现理解空间与物理属性的真实世界原生 AI,最终应用于制造、物流、医疗及通信等领域。