机构:2025年中国PCIe Switch市场规模达45.3亿元,AI服务器场景贡献超七成
相关推荐
澜起科技:目前正在积极推进PCIe 7.0 Retimer及PCIe Switch芯片的研发
火星财经消息,澜起科技在互动平台表示,目前,公司PCIe Retimer芯片的出货以Gen 5产品为主。公司于2025年1月推出PCIe 6.x/CXL 3.x Retimer芯片并向客户送样,目前正积极配合客户测试验证。此外,公司于今年1月发布了PCIe 6.x/CXL 3.x的AEC解决方案。目前公司正在积极推进PCIe 7.0 Retimer及PCIe Switch芯片的研发。
美光科技将与Microchip推出高性能PCIe® Gen 6存储架构
PANews 8月4日消息,据市场消息:美光科技将与 Microchip Technology 推出面向 AI 与数据中心基础设施的高性能 PCIe® Gen 6 存储架构。
英伟达推出NeMo Switchyard,利用AI模型路由技术降低智能体运行成本
Odaily星球日报讯 英伟达(NVIDIA)推出 AI 模型路由系统 NeMo Switchyard,旨在帮助开发者在多个大模型之间动态分配 AI 智能体(AI Agent)任务,在保证性能的同时降低成本和延迟。 英伟达表示,构建 AI 智能体并不意味着必须依赖单一大模型。不同模型在推理能力、响应速度和运行成本方面各有优势,例如分类任务可能适合轻量模型,复杂推理则需要更强大的前沿模型。如果所有请求都发送至最大规模模型,将导致成本和延迟增加;而全部使用小模型则可能降低复杂任务完成质量。NeMo Switchyard 通过智能路由机制,根据任务需求、模型能力、成本、延迟以及系统状态等因素,在多个专用模型和前沿模型之间自动选择最合适的执行模型。该系统支持开发者在不改变应用架构的情况下切换不同模型供应商和模型版本。 英伟达介绍,NeMo Switchyard 提供多种路由策略,包括无需训练的 LLM 分类器路由、阶段路由(Stage Router)、升级路由(Escalation Router),以及基于真实工作负载数据训练的可调节路由模型。其中,升级路由会优先将任务分配给低成本模型,并在检测到任务复杂度提升、持续错误或执行停滞时,将请求升级至更强模型,从而实现性能与成本之间的平衡。 英伟达表示,在相关测试中,NeMo Switchyard 通过在不同模型之间分配任务,在保持较高任务完成率的同时显著降低 AI Agent 运行成本。例如,与仅使用前沿模型相比,基于升级路由的方案在 LangChain 多轮智能体测试中降低约 74%的成本,仅有 7%的请求需要调用前沿模型。 此外,英伟达已与 Cognition、Nous Research、Ramp、LangChain、LiteLLM、Kong 等企业合作,将 NeMo Switchyard 集成至 AI Agent 开发流程和企业应用基础设施中。
Marvell推出AI“内存解耦”架构,将解决Agentic AI推理带宽瓶颈
Odaily星球日报讯 Marvell Technology 宣布推出面向 AI 基础设施的新一代内存解决方案组合,覆盖服务器级 AI 存储、机架级 CXL 内存扩展与池化,以及多机柜光互联共享内存,旨在解决 Agentic AI 推理过程中日益增长的内存容量和带宽瓶颈。 Marvell 表示,随着 AI 模型规模扩大、上下文窗口延长以及 KV Cache 需求增长,传统计算与内存紧耦合架构正限制 AI 推理效率。通过内存解耦(memory disaggregation),可以让内存资源更加独立于计算资源扩展,提高 GPU 利用率并降低数据移动延迟。此次发布的产品包括: Bravera SC6 PCIe 6.0 SSD 控制器:面向 AI 推理存储场景,可帮助云服务商将更多 KV Cache 迁移至高性能 SSD,提升基础设施效率。该产品采用兼容多供应商 NAND 的架构,预计将于 2026 年第四季度开始送样。 Marvell Structera X 内存扩展方案:基于 CXL 技术,支持机架级内存扩展和资源池化,帮助数据中心更灵活地共享和调配内存资源,降低 AI 基础设施成本。 Marvell Photonic Fabric 光互联内存方案:通过光互联技术构建跨多机柜共享内存架构,可支持最高 32TB 温热 KV Cache 卸载,并帮助 AI 推理集群提升吞吐能力。 Marvell 表示,Photonic Fabric 方案可在现有数据中心空间和功耗限制下,实现最高 2 至 3 倍的 Token 吞吐提升,支持更大规模模型和更长上下文 AI 应用。 Marvell 高管 Will Chu 表示,AI 基础设施正在从单一服务器架构转向计算、内存和连接协同运行的系统,未来内存需要更加独立地扩展,以提升资源利用率和 Token 效率。 随着 AI Agent 和大模型推理需求持续增长,内存容量、带宽和数据传输效率正成为继算力之后 AI 基础设施竞争的新焦点。
此芯科技发布AGX Agentic Compute战略
火星财经消息 7月18日消息,此芯科技正式发布AGX Agentic Compute智能体计算战略,并推出全新硬件AGX Station及全栈智能体算力产品系列,覆盖端、边、云全场景应用,以全域算力底座赋能AGI发展。据介绍,此芯科技此次发布的桌面级超算AGX Station,采用创新的模组化、可扩展开放式硬件架构,支持M.2、MXM、PCIe等多种AI算力卡形态,可实现70B至150B参数规模大模型的原生推理,并基于分布式架构实现多智能体(Multi-Agents)并行计算与智能调度。在硬件适配上,AGX Station深度适配天数、后摩、原粒、智辰、光羽等多家国产存算一体AI芯片,同时兼容半高旗舰显卡,并可通过2×10G RDMA实现多机级联、构建桌面集群。(广角观察)
澜起科技:PCIe6.x/CXL3.xRetimer芯片目前正积极配合客户测试验证
火星财经消息,澜起科技(688008.SH)发布投资者关系活动记录表公告,目前,公司PCIeRetimer芯片的出货以Gen5产品为主。在国内市场中,依托优异的产品性能和本土服务支持的双重优势,澜起的PCIeRetimer芯片更受客户青睐。在产品升级迭代方面,公司于2025年1月推出PCIe6.x/CXL3.xRetimer芯片并向客户送样,目前正积极配合客户测试验证。由于支持PCIe6.0的服务器CPU尚未规模量产,相关Retimer芯片仍处于产业导入期,行业预期2027年PCIe6.0Retimer芯片将进入正式的规模应用阶段。此外,我们于今年1月发布了PCIe6.x/CXL3.x的AEC解决方案。(财联社)