返回 7*24 快讯
来源MarsBit

从MWC看国产算力链:CPU、光纤都喊“紧缺” 服务器订单积压排队

火星财经消息,MWC 26上海(世界移动通信大会)6月24日正式开幕。在人工智能赋能千行百业,运营商Token化的当下,诸多算力供应链厂商也参加了本次展会。联想集团一位工作人员称,联想服务器跟国内GPU厂商和CPU厂商都有合作,目前信创市场对服务器需求量很大,但芯片供应紧张,导致大量的订单积压排队。“我听到的是我们现在服务器需要交付的订单量差不多有1500亿人民币,我刚刚还接到一个客户电话催货,现在产品供不应求。”联想这位工作人员表示,预计AI服务器的景气度还会持续一段时间。长飞展台上工作人员介绍,目前用于AI场景的光纤产能紧缺,即便扩产也需要18个月左右,因此,产能紧张还会持续一段时间。其他非AI用的光纤并不缺货,处于正常供应状态。 (澎湃新闻)
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-12 10:56

比特币硬分叉链BIP-110已确定BLAKE2b为新POW算法,可使用普通CPU/GPU挖矿

Odaily星球日报讯 Luke Dashjr 已利用随机的方式确定 BLAKE2b 将作为 BIP-110 链的新 POW 算法,替代比特币目前使用的 SHA-256d 算法。与 SHA-256d 相比,BLAKE2b 更适合使用通用 CPU/GPU 进行挖矿,更偏 CPU 友好,可降低现有比特币 ASIC 矿机的优势。 此前消息,Luke Dashjr 计划将于 9 月 1 日正式实现 BIP-110 硬分叉,使其成为一条独立区块链,并产生区别于比特币的新代币,Luke Dashjr 已被比特币 BIP 编辑团队撤销了比特币 BIP 编辑权限。

07-20 19:30

AMD年度旗舰AI大会来袭 瑞银:CPU/GPU技术路线是重头戏

火星财经消息,AMD年度旗舰AI大会“Advancing AI 2026”将于当地时间7月22日至23日在美国旧金山举行。瑞银发布前瞻报告称,此次活动可能更侧重于展示技术而非公布客户或财务信息,预计AMD将公布数据中心CPU(包含Venice、Verano)与GPU(MI450x以及MI500)技术路线的最新进展;嵌入式、游戏显卡业务也会同步更新相关信息。瑞银予AMD“买入”评级,目标价从670美元上调至700美元。(财联社)

06-27 11:08重要

观点:廉价开源模型泛用导致H100GPU现货租赁价格下跌及token价格指数回落

火星财经消息,6 月 27 日,投研机构 Silicon Data 发布数据指出,廉价开源模型泛用导致 H100 GPU 现货租赁价格下跌及 token 价格指数回落,但该机构认为这并不代表 AI 整体需求减弱,并指出用户大规模转向廉价开源模型反而推动整体计算消耗增加,维持了对高端计算资源的需求。

08-21 11:45

DeepSeek Flash 涨价后流量腰斩,留下近 10 万亿 Token 日缺口

火星财经消息,OpenCode CEO Jay V 表示,DeepSeek V4 Flash 自 8 月 1 日上线后,在 OpenCode 上的日 Token 消耗量从约 3 万亿飙升至 18 万亿,两周内增长 6 倍,接近 OpenRouter 全平台日处理量。其定价约为 Fable 的 1/350、GPT-5.6 Sol 的 1/175、Claude Sonnet 的 1/70,被用户视为“便宜到无需计量的 AI”。8 月 16 日 DeepSeek 将高峰时段价格上调 5 倍(非高峰时段 2.5 倍)后,模型日 Token 消耗量从峰值回落超过 50%。Jay V 认为涨价系应对 GPU 成本上升的被动之举。目前 OpenCode 正寻找能以原价承接流量的供应商,约需 1000 块 B300 才能支撑当前需求。DeepSeek Flash 暴露了 AI 模型市场的“不可能三角”——便宜、强大、大规模稳定供应难以兼得。涨价后,OpenCode Go 已将配额从 60 美元降至 15 美元后又恢复至 30 美元,并引入峰谷费率机制。

08-19 09:13

Cerebras发布CS-4 AI加速器,称推理速度最高达GPU方案30倍

当地时间8月18日,Cerebras发布新一代AI加速器CS-4,称其推理速度最高可达基于GPU方案的30倍。CS-4采用三颗新型WSE-3 Turbo晶圆级引擎,AI算力达750PFLOPS,内存带宽达129.6PB/s。Cerebras表示,在GPT-OSS-120B测试中,CS-4每用户每秒生成超过440个Token,最高达到GPU方案的30倍;其每瓦吞吐量最高为CS-3的10倍,并可支持超过50万亿参数的模型。CS-4预计将于今年第三季度开始出货。(界面)

08-19 01:07重要

英伟达:多GPU UMAP可在8分钟处理870GB向量数据,最高提速74倍

BlockBeats 消息,8 月 19 日,英伟达发布技术博客称,其 cuML 与 cuVS 新增多 GPU UMAP 能力,可将大规模向量数据的降维处理分布至多张 GPU 上执行,在保持嵌入质量的同时显著缩短运行时间。 英伟达表示,在配备 8 张 H100 GPU 的 DGX 系统上,对包含 1.06 亿个向量的 MIRACL 数据集进行测试时,数据规模约 870GB,cuML 多 GPU UMAP 可在 8 分钟内完成端到端处理,相较预计的 CPU 实现速度最高提升 74 倍;此前 CPU 方案即使使用 2TB 内存也无法完成全量处理。 该方案通过将数据划分为多个集群,在不同 GPU 上并行构建局部 k 近邻(kNN)图,再合并为全局图,从而突破单 GPU 显存限制。英伟达称,该技术可将此前需要数小时甚至数天处理的数百 GB 级 UMAP 任务压缩至数分钟。