B.AI 热门模型权益更新,Qwen3.8-Flash 等三款模型将开启 1 折特惠调用
相关推荐
B.AI 延长 GLM-5.3-Flash 免费调用至 9 月 12 日
ChainCatcher 消息,9 月 9 日,智谱 GLM-5.3-Flash 官方调价即将生效。AI 模型调用平台 B.AI 宣布限时延长免费权益,即日起至 9 月 12 日 09:59(SGT),该模型在 B.AI 平台仍可全量免费调用。GLM-5.3-Flash 总参数 320B、激活参数 18B,支持 1M 上下文。Qwen3.8 Flash、Hy3、MiMo V2.5 等模型在 B.AI 平台仍保持免费开放。
小米新一代模型MiMo-X首次亮相:Pro、Flash两款模型开启内测
动察 Beating AI 快讯,小米首次公布新一代 MiMo-X 系列,首批包括 MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview 两款模型。目前公开的体验入口是新推出的 Xiaomi MiMo Desktop,获邀用户可限时、限量、免费使用。官方暂未公布两款模型的参数、上下文长度、基准成绩和 API 开放时间。 MiMo-X 面向复杂推理、多 Agent 协作、大型编程项目、Office、网页与交互设计、视频剪辑、3D 生成、音乐生成和电脑操控等专业工作场景。MiMo Desktop 可以直接读取文档、表格、图片、视频等素材,自动拆任务、调用工具和浏览器,并交付可继续编辑的 PPT、网页、App 等成果;大型任务还能拆给多个 Agent 协作。 小米三周前就在财报会上预告,首个 MiMo 桌面应用和新模型即将推出。这次两者一起进入预览测试。
B.AI 上线智谱 GLM-5.3-Flash 模型并免费开放 API
ChainCatcher 消息,8 月 27 日,一站式 AGI 基础设施平台 B.AI 宣布智谱 GLM-5.3-Flash(320B-A18B)正式登陆平台,并在 API 官方组全量免费开放。作为 GLM-5 系列首款原生全模态模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,由纯国产 AI 芯片提供算力支持,首次引入稀疏与线性注意力混合架构,配合 1M 超长上下文,兼具强悍性能与极致性价比。即日起,开发者可通过 B.AI API 官方组零成本调用,轻松驾驭复杂推理、长文本处理与多模态任务。
Qwen3.8-Flash发布一天就降价:输出比GLM便宜0.1元,但对手还在打5折
动察 Beating AI 快讯,Qwen3.8-Flash 刚发布一天,阿里云就降价了。每百万 Token 输入从 1 元降到 0.8 元,输出从 3 元降到 2.7 元,分别下降 20% 和 10%。 新价格刚好压过昨天发布的 GLM-5.3-Flash。后者 API 标价为输入 0.8 元、输出 2.8 元。Qwen 输入价格相同,输出便宜 0.1 元。 不过 GLM-5.3-Flash 上线后前两周打 5 折,目前实际价格只有输入 0.4 元、输出 1.4 元。优惠期内,GLM 仍然便宜近一半。等优惠结束,两款国产 Flash 模型的价格基本打平。
阿里千问发布Qwen3.8-Flash模型
PANews 8月26日消息,阿里千问发布Qwen3.8-Flash模型,据介绍,这是一款多模态MoE模型,也是Qwen4架构的早期预览版。生产版Qwen3.8-Flash很快将通过Qwen Cloud API提供服务,价格仅为每100万输入Token 0.16美元、每100万输出Token 0.47美元。模型拥有1250亿参数+510亿 N-gram嵌入参数,但每个Token仅激活60亿参数,实现了极高的成本效益。
小米MiMo 系列模型正式登陆 B.AI API
ChainCatcher 消息,B.AI 平台宣布小米自研 MiMo 系列模型正式上线 API 服务,首批开放 MiMo-V2.5 与 MiMo-V2.5-Pro 两款模型。 其中 MiMo-V2.5 为 310B 稀疏 MoE 原生全模态模型,支持图文音视频全模态输入与 1M 超长上下文,专为多模态 Agent 与通用编程场景打造;MiMo-V2.5-Pro 则达到 1.02T 稀疏 MoE 参数规模,定位旗舰文本模型,主攻复杂推理与长周期软件工程,SWE-Bench Verified 基准测试取得 78.9 分的高分表现。 即日起,开发者可通过 B.AI API 调用两款模型,支持官方组接入与自选服务商双重模式,并享低至 4 折优惠。