刘宏云:未来企业将有五大变革,架构将迎代际跃迁
相关推荐
Bitwise CEO:USD AI 推出 GPU 资产抵押信贷并将其代币化
ChainCatcher 消息,Bitwise CEO 在 X 平台发文表示,GPU 是数字时代最重要的大宗商品之一。USD AI 已创建 GPU 资产抵押信贷,为此前未获充分服务的中型借款人提供服务,并将相关信贷代币化。现实世界信贷正逐步上链,Bitwise 将通过 PAPY 提供访问渠道。
FreeToken开源:一张5090跑DeepSeek-V4-Flash,最高25 Token/s
动察 Beating AI 快讯,伯克利、MIT 等研究者开源 FreeToken。这是一个专门为本地设备设计的 MoE(混合专家模型)推理引擎,主要解决超大模型显存装不下的问题。它会把部分权重放在系统内存,并让 CPU 和 GPU 一起参与推理。 FreeToken 会把模型的大量专家权重放在系统内存,只把一部分缓存在显存。遇到显存里没有的专家时,它会根据 PCIe 和 CPU 内存带宽,动态决定是把权重搬到 GPU,还是直接交给 CPU 计算。这样 CPU、GPU、系统内存和 PCIe 可以一起参与推理。 论文实测,一台配备 RTX 5090 的游戏台式机运行 284B 参数的 DeepSeek-V4-Flash,可以达到 22–25 Token/s。这款模型每生成一个 Token 实际只激活约 13B 参数,因此特别适合这种 CPU、GPU 混合推理。 FreeToken 还在 8GB 显存的 RTX 4060 笔记本上把 35B 模型跑到 39.3 Token/s;单张 96GB RTX PRO 6000 则可以运行 753B 参数的 GLM-5.2,速度达到 llama.cpp 的约两倍。项目目前支持超过 20 款 MoE 模型,并已采用 Apache 2.0 许可证开源。
Joe Lubin确认出席,以太坊生态核心力量将在Ethereum Ecosystem Summit集结
Odaily星球日报讯 由 Sharplink、BlockUnion 和 ETH HK Hub 联合发起,Lido Institutional 协办的 Ethereum Ecosystem Summit 将于 2026 年 10 月 8 日在新加坡举行。此次峰会面向以太坊生态建设者、金融机构、投资人与链上基础设施团队,集中讨论以太坊长期价值、机构采用和智能体金融的发展方向。 以太坊联合创始人、Consensys 创始人 Joe Lubin 已确认出席并将与 Sharplink 首席执行官 Joseph Chalom 展开炉边对谈, 围绕 "以太坊十年,从一个想法到开放金融的未来 "回顾以太坊过去十年的发展,并讨论开放金融的下一阶段。 作为 TOKEN2049 期间聚焦以太坊生态的高规格活动之一,本次峰会将围绕三项核心议题展开,包括以太坊的长期价值、基础设施与可信中立性,机构财库、资产代币化与链上基础设施,以及由稳定币、代币化资产、即时结算和自主商业构成的智能体金融技术栈。 大会还获得 SNZ、EthSystems、EthLabs、Ethereum Institutional、HashKey Capital 及 Ethereum Singapore 等生态合作伙伴支持,并将邀请来自以太坊基础设施、流动性质押、数字资产托管、支付与链上金融等领域的代表参与讨论。更多嘉宾及完整议程将于近期公布。
熵旋芯智雷坤:MRAM存算一体芯片可使AI推理Token成本降低约10倍
火星财经消息 9月12日,熵旋芯智创始人兼CEO雷坤在2026算力中国AI与算力产业展览会科创路演活动上表示,基于MRAM的存算一体架构能耗比SRAM低近10倍,可使AI推理Token成本降低约10倍。三星8纳米MRAM已成熟量产,明年将推进至5纳米。目前公司已完成两轮融资(英诺、海贝、君杉),第三轮融资接近收尾。 (财联社)
英伟达给Pi加外挂:Agent自己研究找出4种优化,Token最高省64%
动察 Beating AI 快讯,英伟达 NVLabs 开源 SoL-Pi,给 Coding Agent Harness「Pi」加了一层效率优化。研究团队搭了一套自动研究流程,让多个 Agent 分析 Pi 的运行轨迹、提出优化方案、改代码并自动验证。最初有 152 个候选方向,最后只留下 4 个。 这 4 个优化都在减少重复开销。比如改完代码后直接接着跑测试,少一次模型调用;读过的大文件和长输出先存到本地,需要时再取;子任务结束后判断要不要压缩上下文;超长日志先交给便宜模型筛重点,再核对内容确实来自原日志。 在 EdgeBench 上,SoL-Pi 相比原版 Pi 少用 45%–49% Token,成本低约三分之一;相比 Codex、Claude Code 的原生 Harness,Token 少 35%–64%,按 API 标价计算成本低 50%–54%。 不过省钱会损失一点能力,SoL-Pi 保留了 Pi 约 94% 的平均得分;在 Terminal-Bench 4 的 63 个 CPU 任务里,它解出 15 个,Codex 和 Pi 都是 18 个。
中科曙光发布scaleFabric Token加速技术体系
火星财经消息,近日,中科曙光发布scaleFabric Token加速技术体系,实现IBGDA技术在国内首次规模化应用。该体系以原生无损RDMA高速网络为基础,构建“算存传”三级紧耦合的Token加速超级通道,其中,支持GPU直接发起网络通信的IBGDA技术实现在国内的首次规模化落地,已在十万卡级大规模集群中完成验证。目前,scaleFabric已经完成DeepEP等通信框架适配,并通过IBGDA、存储直通等技术提升Token流转效率,为国产大模型提供新的高速互连选择。