返回 7*24 快讯
来源MarsBit

沐曦股份曦云C系列GPU Day 0 适配智谱GLM-5.2旗舰模型

火星财经消息,6月17日,智谱AI全新旗舰大模型GLM-5.2正式开源发布。沐曦股份曦云C系列GPU率先完成该模型Day 0适配。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-14 23:36

AMD宣布为阿里千问模型Qwen3.8 27B提供“Day 0”支持

Odaily星球日报讯 AMD 宣布为阿里通义千问(Qwen)最新一代模型 Qwen3.8 27B 提供“Day 0”支持,开发者可在模型发布当天即可通过 AMD 硬件本地运行该大规模开源 AI 模型。 AMD 表示,Qwen3.8 27B 是一款适合本地 AI 开发的 27B 参数密集型模型,延续 Qwen 系列在代码生成、实际工作任务、科研以及长上下文 AI 应用方面的优化方向。该模型可通过开源推理框架 llama.cpp 运行于搭载 AMD 处理器的 AI PC 和工作站,或单张 AMD 32GB 显卡上,同时支持具备超过 24GB 可变显存(VGM)或显存容量的 AMD 硬件平台。 AMD 初步测试显示,Qwen3.8 27B 在 AMD 平台上具备较高本地推理性能:在 AMD Ryzen AI Max+ 395 处理器上,最高可达到 24.5 tokens/秒;在单张 Radeon AI PRO R9700 GPU 上,最高可达到 51.8 tokens/秒。测试基于 Windows 系统、llama.cpp Vulkan 后端,并启用多令牌预测(MTP)优化。AMD 表示,随着后续软件和模型优化推进,实际性能仍有提升空间。

06-17 09:21

智谱上线并开源 GLM-5.2,专注 Coding 与长程任务

Foresight News 消息,智谱(02513.HK)今日发文称,上线并开源 GLM-5.2。GLM-5.2 专为长程任务能力而生,特色包括:Solid1M 上下文,稳定支撑长程任务;更强体感,更实用的 Coding 能力;极致 Infra 优化,Day0 运行在国产算力平台;MIT 开源协议,无地域限制,技术平权无国界。

06-04 12:00

Aethir推出自研开源LLM API平台Aethir Mesh,DeepSeek V4、Kimi K2.6等顶级模型推理全程跑在Aethir GPU上

BlockBeats 消息,6 月 4 日,据官方消息,Aethir 正式发布 Aethir Mesh——一个运行于 Aethir 去中心化 GPU 基础设施之上的自研开源大模型 API 平台,目前提供统一 API 端点直连 DeepSeek V4、Kimi K2.6、GLM-5.1、MiniMax-M2.5、Qwen3.6-27B 等主流开源模型。 与 OpenRouter 等聚合路由方案不同,Aethir Mesh 由 Aethir 自有算力直接提供推理服务,无转售溢价、无第三方路由。 Aethir Claw 用户可将 Mesh API Key 直接写入智能体配置,实现从 VPS 托管到模型推理的全栈闭环,推理数据全程不离开 Aethir 生态。 平台现已上线:https://agent.aethir.com/twitterCNmesh

05-22 11:19

智谱发布GLM-5.1高速版API,输出速度达400 tokens/s

Odaily星球日报讯 智谱面向部分企业客户推出 GLM-5.1 高速版 API,其模型输出速度达到 400 tokens/s,刷新全球大模型官方接口端到端速度纪录。 据了解,该高速版在保留原有旗舰模型能力基础上,由智谱与 TileRT 团队联合研发的高性能推理引擎驱动。该引擎通过重构 GPU 运行调度机制,将模型静态编排为常驻 GPU 的 persistent Engine Kernel,以降低传统推理中的内核启动与显存读写延迟。 在多卡场景下,TileRT 进一步将 8 卡 NVL 拓扑中的 GPU 节点特化为不同功能 Worker,以提升注意力层计算与跨卡通信效率。 目前,该高速版服务已向智谱 MaaS 平台部分企业客户开放。未来将继续优化 FP8 推理及超长上下文能力,面向 AI 编程、实时交互与实时语音等低延迟场景提供支持。

08-16 09:24

Citrini观点:英伟达5000亿美元融资担保有望支撑GPU销售,不属于循环融资

火星财经消息,8 月 16 日,Citrini 分析师 Jukan 发文表示,英伟达与华尔街规模达 5000 亿美元的融资担保安排,有助于避免超大规模云服务商在现金流趋紧、无法再完全以预付款方式购买 GPU 时,对 GPU 销售造成冲击。 他认为,这一安排还将加速 GPU 市场总可寻址市场(TAM)的扩张,并不属于「循环融资」。一个值得关注的变化是,华尔街正越来越多地将 GPU 视为可以回收价值的抵押品。

08-16 09:02

ZCode免费送1亿GLM-5.3 Token,太火导致上线一小时就暂停

据动察 Beating 监测,智谱旗下编程 Agent 工具 ZCode,给 GLM-5.3 推出了一场周末免费活动。新用户首次登录 ZCode,即可获得 1 亿 GLM-5.3 Token,用于 AI 编程、代码修改和 Agent 任务。 活动原定北京时间 8 月 16 日 0 点开始,持续到 17 日上午 9 点。结果上线一小时,ZCode 就宣布暂停新增 1 亿 Token 发放。官方称活动需求「超出预期」,正在调整服务容量。 已经领取的额度不受影响,普通新用户的 300 万 GLM-5.3 Token 福利仍然开放。ZCode 表示,等容量恢复后会重新开启 1 亿 Token 活动。