B.AI 上线智谱 GLM-5.3-Flash 模型并免费开放 API
相关推荐
GLM-5.3-Flash 免费体验即将收官,1 折特惠无缝接棒
ChainCatcher 消息,B.AI 宣布 GLM-5.3-Flash 限时免费体验即将告一段落,1 折专属调用特惠将于 9 月 12 日 10:00(SGT)起无缝接棒,用户仅需支付原价的 10%,直接节省 90%,输入低至 $0.015/M、输出低至 $0.05/M。作为原生全模态大模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,结合稀疏与线性注意力混合架构及 1M 超长上下文,在编程开发、智能体、长上下文处理及高频 API 工作负载等场景下表现强劲。B.AI 始终践行算力普惠愿景,坚持低门槛接入,致力于以极具竞争力的价格,让每一位开发者都能无负担使用顶级算力,告别高昂成本,全速推进创新落地。
DeepSeek-V4-Flash 持续免费开放,B.AI 一站式 AGI 基础设施赋能创新
ChainCatcher 消息,8 月 20 日,B.AI 平台 DeepSeek-V4-Flash 零门槛免费开放活动持续进行中。B.AI 秉持“普惠算力”愿景,致力于打造全球领先的一站式 AGI 基础设施,持续降低 AI 使用门槛,让开发者和 Web3 用户轻松体验、构建与部署 Agentic 应用。依托一站式 AGI 基础设施,B.AI 聚合全球前沿模型矩阵,内置智能路由优化成本与效率;稳定承载百万级长上下文、Agent 工作流等高吞吐场景;弹性 API 路由兼顾生产级高可用与极致性价比;Web2/Web3 双通道打通加密资产与法币结算。目前 DeepSeek-V4-Flash 在 Web 与 API 双端持续免费开放,$0 畅用顶尖模型能力。
B.AI 延长 GLM-5.3-Flash 免费调用至 9 月 12 日
ChainCatcher 消息,9 月 9 日,智谱 GLM-5.3-Flash 官方调价即将生效。AI 模型调用平台 B.AI 宣布限时延长免费权益,即日起至 9 月 12 日 09:59(SGT),该模型在 B.AI 平台仍可全量免费调用。GLM-5.3-Flash 总参数 320B、激活参数 18B,支持 1M 上下文。Qwen3.8 Flash、Hy3、MiMo V2.5 等模型在 B.AI 平台仍保持免费开放。
Qwen3.8-Flash发布一天就降价:输出比GLM便宜0.1元,但对手还在打5折
动察 Beating AI 快讯,Qwen3.8-Flash 刚发布一天,阿里云就降价了。每百万 Token 输入从 1 元降到 0.8 元,输出从 3 元降到 2.7 元,分别下降 20% 和 10%。 新价格刚好压过昨天发布的 GLM-5.3-Flash。后者 API 标价为输入 0.8 元、输出 2.8 元。Qwen 输入价格相同,输出便宜 0.1 元。 不过 GLM-5.3-Flash 上线后前两周打 5 折,目前实际价格只有输入 0.4 元、输出 1.4 元。优惠期内,GLM 仍然便宜近一半。等优惠结束,两款国产 Flash 模型的价格基本打平。
「牛来」模型GLM-5.3-Flash正式开源:320B 参数仅激活 18B,价格只有 GLM-5.2 十分之一
动察 Beating AI 快讯,白天认领 Ox Alpha 后,智谱晚上正式开源 GLM-5.3-Flash,模型权重已经上线 Hugging Face,采用 MIT 许可。它总参数 320B,但每次只激活 18B,原生支持文字、图片和视频,也是 GLM-5 系列首个原生多模态模型。 官方称,GLM-5.3-Flash 整体性能超过 GLM-5.2,编程和 Agent 评测已经接近 Claude Opus 4.8,但价格只有 GLM-5.2 的十分之一。它还换了一套新的基础模型,首次在 GLM 主系列引入稀疏注意力和线性注意力混合架构,并用 30T Token 多模态数据预训练。 此前社区对 Ox Alpha 的 DeepSWE 小样本测试一度跑出 80%,但那只有 10 道题。扩大样本后成绩回落到约 63%,测试者也主动纠正了最初的说法。这个成绩依然属于第一梯队,但没有最初 80% 那么夸张。 权重开源后,开发者可以直接用 vLLM、SGLang、KTransformers 等框架自己部署,不需要再走匿名模型的 API。
DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一
动察 Beating AI 快讯,Artificial Analysis 完成 DeepSeek V4.1 Flash 独立测试,综合智能指数拿到 40 分。它已经超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这套第三方榜单,DeepSeek 还没夺回国产模型第一。 但价格差距非常夸张。V4.1 Flash 跑完一个 Intelligence Index 任务平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差约 7 倍。输出速度达到 197 Token/s,也远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。 Agent 依然是它最强的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 也拿到 84%。缺点是它特别能说,AA 测试中单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,吃掉了一部分价格优势。