算力租赁概念震荡拉升 二六三涨停
相关推荐
美股盘前要闻一览:黄仁勋表态英伟达明年芯片销量翻倍,苹果拟重返服务器市场,Nebius将上调部分GPU算力价格
BlockBeats 消息,9 月 17 日,美股盘前市场重要新闻一览如下: 据 BIT(bit.com) 行情数据,美股三大股指期货集体走高。道琼斯指数期货涨 1.18%,标普 500 指数期货涨 1.26%,纳斯达克 100 指数期货涨 1.66%。 据 Bitget 行情数据,金银现货延续涨势。现货黄金价格涨 2.54%,报 4372.26 美元/盎司;现货白银价格涨 3.70%,报 65.29 美元/盎司。 黄仁勋刚刚表示:英伟达明年芯片销量将达到今年的两倍。英伟达 (NVDA.O) 盘前上涨 2.2%。 苹果考虑重返服务器市场,并已与英伟达就使用网络技术进行洽谈。计划推出的服务器预计将于 2029 年上市,目标市场为人工智能推理领域。 AI 算力租赁商 Nebius 拟于 10 月 1 日起上调部分 GPU 算力价格,涨幅约 20%。受此提振,Nebius 盘前涨近 10%,甲骨文涨近 3%,亚马逊、微软、谷歌等跟涨。 英特尔 CEO 表示,目前公司的 CPU 供货量仅能满足客户需求的 50%。他同时透露,英特尔 18A 节点已进入量产,14A 节点将于明年一季度投产。 诺和诺德将与 AI 公司 Anthropic 合作,使用其面向科学研究的 Claude Science 平台加快新药研发进程,有望将原本需一世纪的医学突破压缩到十年内实现。 美国国际贸易委员会当地时间 9 月 16 日宣布,已对某些配备特定音频技术的电子设备展开专利侵权调查。调查对象包括三星电子及其美国子公司、苹果和谷歌。 马斯克称,他已住进一辆房车里,亲身参与 SpaceX 位于孟菲斯的数据中心 Colossus 项目。SpaceX 现已将算力租赁业务推广至谷歌和 Anthropic。 阿波罗资管考虑把给软银的贷款规模从 54 亿美元增加到 90 亿美元,助力其加码投资 OpenAI。
GPU租赁最高涨21%,云计算服务提供商Nebius盘前涨超9%
Odaily星球日报讯 根据 MSX.COM 数据,云计算服务提供商 Nebius 美股盘前进一步涨超 9%。 Nebius 此前宣布,自 10 月 1 日起上调多项按需计算资源价格,其中最新英伟达 GPU 涨幅最大。新价格下,H100 由 3.85 美元/GPU 小时升至 4.50 美元/GPU 小时,涨幅约 17%;H200 由 4.50 美元升至 5.40 美元,涨幅 20%;B200 由 7.15 美元升至 8.50 美元,涨幅近 19%;英伟达 B300 绝对涨幅最大,由 7.85 美元升至 9.50 美元/GPU 小时,涨幅约 21%。提价也涉及纯 CPU 计算。AMD EPYC Genoa CPU 费率由 0.012 美元/vCPU 小时上调 25%至 0.015 美元;Genoa 内存由 0.0032 美元/GiB 小时上调约 41%至 0.0045 美元。
Nebius拟发行45亿美元可转债,用于扩建数据中心和采购GPU
BlockBeats 消息,8 月 20 日,AI 云计算公司 Nebius Group 宣布,计划通过私募方式发行总额 45 亿美元的可转换优先债券,包括 2030 年到期的 27.5 亿美元债券和 2034 年到期的 17.5 亿美元债券。 Nebius 表示,募集资金将用于推动业务扩张,包括建设和扩建数据中心、发展全栈 AI 云平台、扩大数据中心布局,以及采购 GPU 等关键基础设施设备。 此外,公司预计将与部分 2029 年及 2031 年到期可转债持有人进行私下换股交易,以优化债务结构。此次发行仍需满足市场条件,最终利率、转换价格等条款将在定价时确定。
英伟达宣布 Groq 机架全面量产,将部署于 Nebius
火星财经消息,英伟达高级总监 Dion Harris 当地时间周一宣布,Groq 3 LPX 机架已进入全面量产阶段,并将部署在新型云服务商 Nebius 的数据中心,预计今年晚些时候上线。此举标志着英伟达去年 12 月与 Groq 达成约 200 亿美元技术授权交易后所获技术正式实现商业化,多位 Groq 核心员工已加入英伟达,创始人 Jonathan Ross 担任英伟达首席软件架构师。英伟达正加速生产 Groq 芯片并向客户提供产品,凸显低延迟推理的重要性。今年 3 月发布的 Groq 3 LPX 为 Vera Rubin 平台推理加速器,架构在芯片裸片上集成 500 兆字节高速 SRAM,以减少内存瓶颈。每个 LPX 机架可整合 256 颗 Groq 3,英伟达援引基准测试称每秒可处理 3400 个 token;该芯片由三星制造。Harris 表示,低延迟芯片并非取代 GPU,而是针对工作负载不同环节使用合适处理器,云服务商可对延迟敏感用户提供更高收费套餐。英伟达 CEO 黄仁勋计划将面向编程应用的数据中心空间约四分之一分配给 Groq 芯片,其余部分采用 Vera Rubin 系统,并预计到 2027 年 Blackwell 与 Vera Rubin 累计销售额达 1 万亿美元。
花旗维持对Nebius「买入/高风险」评级,目标价278美元
火星财经消息,8 月 13 日,花旗在最新报告中表示,Nebius 当前增长瓶颈并非需求,而是产能上线节奏。该行维持对 Nebius「买入/高风险」评级,目标价 278 美元。 报告称,Nebius 二季度收入强劲,受资产 SLA 收入、Token Factory、Tavily、更高利用率和按需需求推动。管理层表示,市场需求仍非常强劲,每块 GPU 背后都有多个买家,订单积压增长来自核心 AI 云业务中更大的平均订单规模和中期合同增加。 在近期美股 AI 交易中,neoclouds 正成为新的关注点。英伟达 5000 亿美元 AI 基建融资计划、CoreWeave 财报和 Lumentum 强劲指引后,市场开始寻找谁能拿到 GPU、谁能融资建站、谁能将算力转化为收入。 花旗特别提到,Nebius 约 50%-60% 的基础设施资本开支由客户前期预付款支持。从现金口径看,项目回本期可低于一年,约 10 个月。这有助于缓解市场对 neocloud 模式资金压力的担忧。 真正考验将在下半年。Nebius 预计,大部分已签约产能将在 2026 年下半年上线,微软相关部署也将遵循类似节奏。800MW 至 1GW connected power 目标仍可实现,但转为 active power 仍需网络测试、集成和调试,收入确认会有滞后。 管理层还称,70 亿至 90 亿美元 ARR 框架并不依赖单一项目,而是由利用率、定价和产能增长共同驱动。大部分 5GW 已签约产能预计将在未来两到三年逐步爬坡。 花旗仍提醒,Nebius 属于高风险标的,风险包括客户集中、资本开支强度高、GPU 供应和融资条件不确定。换言之,Nebius 的 AI 算力故事仍清晰,但股价将高度依赖交付节奏。
DFlash团队进军Mac,27B模型跑到144Token/s
动察 Beating AI 快讯,Inco AI 开源本地推理引擎 Splash,把 Qwen3.8-27B 在 M5 Max MacBook Pro 上跑到了最高 144 Token/s。LM Studio 随即接入,0.4.25 版本已经可以直接使用。 Inco 此前做出的 DFlash 已经进入 SGLang、vLLM、TensorRT-LLM 和 llama.cpp。Meta、NVIDIA、小米、Poolside 等也给自家模型配了 DFlash 加速小模型。DFlash 会先让小模型并行猜出多个 Token,再交给大模型批量验证,减少逐 Token 生成的计算。 Splash 把这种优化扩到了整个本地推理引擎。它目前只支持 Qwen3.8-27B 和 Qwen3.6-35B-A3B,每个模型都单独配了 GPU kernel、内存方案和 DFlash 2 小模型。覆盖的模型少,但换来了更激进的性能优化。 144 Token/s 是 M5 Max 上的最高演示值。换到 Inco 用来做横向测试的 48GB M5 Pro,Qwen3.8-27B 单路短上下文达到 74 Token/s;4 路并发时总吞吐达到 170 Token/s,是第二名的 3.9 倍。这也是 Splash 更适合 Agent 场景的地方。一个 Agent 同时拉起多个子任务时,并发总吞吐往往比单条对话速度更重要。 Splash 本身开源,不绑定 LM Studio。目前需要 M3 或更新的 Mac、macOS 26.4 以上、至少 36GB 统一内存。