返回 7*24 快讯
来源MarsBit

AMD发布全开源MoE大模型Instella-MoE,16B参数规模挑战主流开源模型

火星财经消息,7 月 25 日,AMD 宣布推出全开源混合专家模型(MoE)Instella-MoE,该模型拥有 160 亿总参数,每个 Token 激活 28 亿参数,号称在同规模开源语言模型中具备领先性能。 AMD 表示,Instella-MoE 完全基于自家 AMD Instinct MI300X 和 MI325X GPU,以及 ROCm 软件栈从零训练完成,并采用 Gated Multi-head Latent Attention(Gated MLA)和 FarSkip-Collective 等架构创新,以提升训练和推理效率。 性能测试显示,Instella-MoE-16B-A3B 基础模型平均得分达到 76.7 分,在全开源模型中排名领先,超过 SmolLM3-3B、OLMo-3-7B 等模型,并在仅激活 28 亿参数的情况下,与更大规模模型竞争。 此外,该模型支持 64K Token 长上下文处理,并完成预训练、中期训练、长上下文扩展、监督微调(SFT)、直接偏好优化(DPO)以及强化学习(RL)等完整训练流程。 AMD 此次同步公开 Instella-MoE 全部模型权重、训练配置、数据配比、中间检查点及推理代码,推动开放 AI 模型研究与复现。 AMD 表示,Instella-MoE 展示了基于 AMD 硬件和开放软件生态进行大规模 MoE 模型训练的能力,未来将继续推进更大规模、更强推理能力和更高效率的开源语言模型研发。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-04 07:37

SemiAnalysis:AMD股价若涨至600至700美元,Meta与OpenAI的GPU资本成本或降至零

BlockBeats 消息,8 月 4 日,半导体与 AI 独立研究机构 SemiAnalysis 发文表示,AMD 于去年末及今年初分别与 Meta、OpenAI 达成协议,向两家公司提供与业绩挂钩的认股权证。相关权证将根据最多 6GW AMD Instinct GPU 的采购及部署进度归属,同时还取决于 AMD 股价能否跨越多个门槛,最高门槛为 600 美元。 AMD 股价已由 2026 年初约 200 美元升至目前约 500 至 600 美元。假设与股价相关的权证归属大致呈线性变化,且 6GW 容量全部完成部署,Meta 与 OpenAI 每颗 GPU 的小时资本成本将分别由约 2.15 美元和 2.50 美元,降至约 1.60 美元和 1.75 美元。 SemiAnalysis 表示,若 AMD 股价升至 600 至 700 美元区间,两家公司仅就 GPU 而言的资本成本可能实际降至零。若 AMD 持续改善软件栈、获得更多大型客户订单,并推动股价升至 1000 美元以上,则包括服务器设备、网络及 CPU 在内的整个集群资本成本,理论上也可能降至接近零。

08-07 08:31

AMD宣布收购AI推理芯片公司Taalas,强化推理市场布局

BlockBeats 消息,8 月 7 日,AMD 宣布已与 AI 推理芯片公司 Taalas 达成最终收购协议。Taalas 成立于 2023 年,总部位于加拿大多伦多,专注于通过优化推理数据流来大幅减少通用架构带来的计算和内存瓶颈,实现高效优化的 AI 推理能力。AMD 计划将 Taalas 技术整合至其全栈 AI 平台,包括 AMD Helios 机架级解决方案、AMD Instinct GPU、AMD EPYC CPU 及 AMD ROCm 软件,以提供系统级解决方案。 AMD 人工智能集团高级副总裁 Vamsi Boppana 表示,Taalas 的技术和世界级工程团队将通过差异化的推理性能和效率进一步增强 AMD 的 AI 产品组合。随着 AI 向更多实时、高容量应用场景扩展,此次收购将帮助客户在日益增长的应用中更高效地部署推理工作负载。Taalas 联合创始人兼 CEO Ljubisa Bajic 表示,公司创立初衷是围绕模型重建硬件,加入 AMD 将获得加速创新所需的规模、工程资源和全球影响力。

08-05 21:16

AMD宣布推出企业级AI编程平台AMD Instinct Coder

PANews 8月5日消息,AMD官方宣布推出企业级AI编程平台AMD Instinct Coder,该平台结合AMD芯片、Supermicro服务器及Spectro Cloud软件,旨在帮助企业在本地部署AI编码助手,降低云端AI模型使用成本并保护代码及数据安全。

08-05 12:40

Cursor重排GPU流水线,MoE模型训练提速41%

据动察 Beating 监测,Cursor 开源 Mixture-of-Kittens(MoK),用于加速 MoE 大模型训练。它把原本分开的 GPU 数据传输和计算,合进一个 kernel(直接在 GPU 上运行的底层程序)。 MoE 会把模型拆成大量「专家」,每次只调用其中一部分。专家分散在不同 GPU 上,数据需要频繁搬运,有时会占掉一半以上的训练时间。 MoK 让 GPU 一边传数据,一边做计算,减少等待。在 512 块 GB300 GPU 的实际训练中,整体吞吐提高 41%。单独测试 MoE 层时,最高比公开方案快 2.37 倍。 MoK 已用于 Cursor 数万块 GPU 的 Composer 训练,并以 Apache 2.0 开源。目前只支持英伟达 Blackwell GPU,主要面向拥有 GB200、GB300 NVL72 集群的机构。

07-22 20:28

Anthropic将于2027年上半年开始购买AMD最新一代芯片Instinct MI450

PANews 7月22日消息,据华尔街日报:Anthropic将于2027年上半年开始购买多达2吉瓦的AMD(AMD.O)最新一代芯片(名为Instinct MI450)。

07-20 21:02

AMD发布首款机架级AI系统Helios,微软加入采购阵营,挑战英伟达AI算力霸权

火星财经消息,7 月 20 日,AMD 正式推出首款面向人工智能的机架级系统 Helios,并宣布微软将在 Azure 数据中心部署该系统,成为继 Meta、OpenAI、Oracle 等企业之后的又一重要客户。 Helios 被视为 AMD 近年来挑战英伟达 AI 基础设施优势的关键产品,也是首个直接对标英伟达 Grace Blackwell 和 Vera Rubin 系统的 AI 机架方案,预计将于今年晚些时候开始交付。 微软表示,将利用 AMD Helios 支持前沿模型推理、AI 应用开发及 Azure AI 服务,并同步推出基于 AMD 最新「Venice」CPU 的两类计算实例,用于智能体 AI 和半导体设计等场景。 AMD 称,Helios 整合了公司自研 GPU、CPU、网络芯片和软件生态,可提供更低的每 Token 成本。该系统采用 MI400 系列 GPU,每个计算托盘搭载 4 颗 Instinct GPU 和 1 颗 EPYC CPU。 目前,Meta 计划部署最高 1GW 规模的 Helios 系统,OpenAI、Oracle 等公司也已宣布采用相关方案。AMD 表示,全球十大 AI 公司中已有 8 家运行其 Instinct GPU 工作负载。