从MWC看国产算力链:CPU、光纤都喊“紧缺” 服务器订单积压排队
相关推荐
比特币硬分叉链BIP-110已确定BLAKE2b为新POW算法,可使用普通CPU/GPU挖矿
Odaily星球日报讯 Luke Dashjr 已利用随机的方式确定 BLAKE2b 将作为 BIP-110 链的新 POW 算法,替代比特币目前使用的 SHA-256d 算法。与 SHA-256d 相比,BLAKE2b 更适合使用通用 CPU/GPU 进行挖矿,更偏 CPU 友好,可降低现有比特币 ASIC 矿机的优势。 此前消息,Luke Dashjr 计划将于 9 月 1 日正式实现 BIP-110 硬分叉,使其成为一条独立区块链,并产生区别于比特币的新代币,Luke Dashjr 已被比特币 BIP 编辑团队撤销了比特币 BIP 编辑权限。
AMD年度旗舰AI大会来袭 瑞银:CPU/GPU技术路线是重头戏
火星财经消息,AMD年度旗舰AI大会“Advancing AI 2026”将于当地时间7月22日至23日在美国旧金山举行。瑞银发布前瞻报告称,此次活动可能更侧重于展示技术而非公布客户或财务信息,预计AMD将公布数据中心CPU(包含Venice、Verano)与GPU(MI450x以及MI500)技术路线的最新进展;嵌入式、游戏显卡业务也会同步更新相关信息。瑞银予AMD“买入”评级,目标价从670美元上调至700美元。(财联社)
观点:廉价开源模型泛用导致H100GPU现货租赁价格下跌及token价格指数回落
火星财经消息,6 月 27 日,投研机构 Silicon Data 发布数据指出,廉价开源模型泛用导致 H100 GPU 现货租赁价格下跌及 token 价格指数回落,但该机构认为这并不代表 AI 整体需求减弱,并指出用户大规模转向廉价开源模型反而推动整体计算消耗增加,维持了对高端计算资源的需求。
DeepSeek Flash 涨价后流量腰斩,留下近 10 万亿 Token 日缺口
火星财经消息,OpenCode CEO Jay V 表示,DeepSeek V4 Flash 自 8 月 1 日上线后,在 OpenCode 上的日 Token 消耗量从约 3 万亿飙升至 18 万亿,两周内增长 6 倍,接近 OpenRouter 全平台日处理量。其定价约为 Fable 的 1/350、GPT-5.6 Sol 的 1/175、Claude Sonnet 的 1/70,被用户视为“便宜到无需计量的 AI”。8 月 16 日 DeepSeek 将高峰时段价格上调 5 倍(非高峰时段 2.5 倍)后,模型日 Token 消耗量从峰值回落超过 50%。Jay V 认为涨价系应对 GPU 成本上升的被动之举。目前 OpenCode 正寻找能以原价承接流量的供应商,约需 1000 块 B300 才能支撑当前需求。DeepSeek Flash 暴露了 AI 模型市场的“不可能三角”——便宜、强大、大规模稳定供应难以兼得。涨价后,OpenCode Go 已将配额从 60 美元降至 15 美元后又恢复至 30 美元,并引入峰谷费率机制。
Cerebras发布CS-4 AI加速器,称推理速度最高达GPU方案30倍
当地时间8月18日,Cerebras发布新一代AI加速器CS-4,称其推理速度最高可达基于GPU方案的30倍。CS-4采用三颗新型WSE-3 Turbo晶圆级引擎,AI算力达750PFLOPS,内存带宽达129.6PB/s。Cerebras表示,在GPT-OSS-120B测试中,CS-4每用户每秒生成超过440个Token,最高达到GPU方案的30倍;其每瓦吞吐量最高为CS-3的10倍,并可支持超过50万亿参数的模型。CS-4预计将于今年第三季度开始出货。(界面)
英伟达:多GPU UMAP可在8分钟处理870GB向量数据,最高提速74倍
BlockBeats 消息,8 月 19 日,英伟达发布技术博客称,其 cuML 与 cuVS 新增多 GPU UMAP 能力,可将大规模向量数据的降维处理分布至多张 GPU 上执行,在保持嵌入质量的同时显著缩短运行时间。 英伟达表示,在配备 8 张 H100 GPU 的 DGX 系统上,对包含 1.06 亿个向量的 MIRACL 数据集进行测试时,数据规模约 870GB,cuML 多 GPU UMAP 可在 8 分钟内完成端到端处理,相较预计的 CPU 实现速度最高提升 74 倍;此前 CPU 方案即使使用 2TB 内存也无法完成全量处理。 该方案通过将数据划分为多个集群,在不同 GPU 上并行构建局部 k 近邻(kNN)图,再合并为全局图,从而突破单 GPU 显存限制。英伟达称,该技术可将此前需要数小时甚至数天处理的数百 GB 级 UMAP 任务压缩至数分钟。