返回 7*24 快讯
来源MarsBit

灵犀专业版Day 0首发接入智谱GLM-5.3-Flash

火星财经消息,8月26日,金山办公旗下AI办公智能体灵犀专业版宣布Day 0首发接入智谱GLM-5.3-Flash模型。该模型此前以匿名身份在OpenRouter、OpenCode测试走红,被社区称为“牛来大模型”(Ox-Alpha)。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-04 08:21

智谱再发匿名模型:GLM-5.3-Flash刚转正,Omen Alpha又来了

动察 Beating AI 快讯,OpenCode 又上线一个匿名模型 Omen Alpha,而这次身份似乎已经提前露馅。OpenCode 自己的数据页直接把它归在 Zhipu 名下。智谱目前还没有正式认领,也没有公布它究竟是哪款 GLM。 这离上一个匿名模型揭晓只有 9 天。智谱此前把 GLM-5.3-Flash 化名为 Ox Alpha,在 OpenRouter 和 OpenCode 免费测试。8 月 26 日才正式公布真身,并开放模型权重。 但这次没有免费午餐了,Omen Alpha 只给每月 10 美元的 OpenCode Go 用户使用,套餐提供价值 100 美元的 Omen 用量。每百万 token 输入收费 0.20 美元,输出 0.66 美元,比 GLM-5.3-Flash 正式价格高约三成;但 GLM-5.3-Flash 目前正在打五折,按现价算,Omen Alpha 大约贵 1.6 倍。 Omen Alpha 的正式规格目前还是空白。OpenCode 没公布上下文、输入模态和最大输出。社区已经有人猜它可能是新的 GLM-5.x 或 Omni 分支。

08-26 08:18

「牛来」模型Ox Alpha就是 GLM-5.3 Flash?预测市场超九成认定智谱

动察 Beating AI 快讯,神秘模型 Ox Alpha 的身份竞猜已经明显倒向智谱。Polymarket 上,Z.ai 的概率目前超过 90%,第二名 Google 只有约 5%。Ox Alpha 是最近突然出现在 OpenRouter 上的匿名推理模型,主打编程和长时间 Agent 任务。 最硬的线索来自后端。社区开发者故意向 OpenCode 的 Ox Alpha 接口发送错误参数,服务器吐出了 com.wd.paas.api.domain.v4.chat.ChatCompletionRequest。其中的 paas/v4/chat 与 Z.ai 官方 API 路径直接对上。继续发送非法 role 时,Ox Alpha 又返回 1214 Incorrect role information,和 Z.ai 自己托管的 GLM 一致。换成 DeepInfra 托管同一 GLM 权重,报错格式就变了。 模型本身的指纹也对上了。一份公开取证跑了 600 多次请求、约 1350 万输入 Token,44 组分词器测试全部匹配 GLM-5 这一代。

08-24 02:27

匿名模型“牛来”刷新OpenRouter纪录 技术线索被指关联GLM

火星财经消息,近日,代号Ox‑Alpha的匿名模型上线大模型聚合平台OpenRouter,被中文社区称作“牛来”模型。该模型支持百万Token上下文与多模态输入,上线首日调用量登顶平台并刷新单日纪录,其还在OpenCode平台终结DeepSeek长达56天的榜首位置。OpenCode官方公告称,该模型背后提供方每天拥有100万亿(100T)tokens的算力。目前初步技术线索猜测其或与GLM系列有关,《科创板日报》记者向智谱求证,暂未获回应。 (科创板日报记者 李明明)

08-21 03:11

「牛来」模型 ?OpenRouter又放匿名模型,Ox Alpha疑似小米MiMo新模型

动察 Beating AI 快讯,OpenRouter 上线新匿名模型 Ox Alpha,定位为面向代码、长时间 Agent 工作和真实生产环境的前沿模型,支持 100 万 Token 上下文,并支持文本、图片、视频输入。目前模型免费开放测试,提供方不会使用用户的 prompt 和输出训练模型。 Ox Alpha 的身份暂未公开,但社区普遍猜测它可能来自小米 MiMo 团队。小米 CFO 林世伟此前也透露,新一代 MiMo 模型正在训练中,有望很快发布。 在 OpenRouter 上匿名放新模型已经快成中国模型厂商的固定节目。此前智谱的 GLM-5、小米的 MiMo-V2-Pro 和 MiMo-V2-Omni、蚂蚁的 Ling-2.6-flash、美团的 LongCat-2.0,都曾先换个名字在 OpenRouter 免费跑一轮,再公开真实身份。

08-26 14:15

「牛来」模型GLM-5.3-Flash正式开源:320B 参数仅激活 18B,价格只有 GLM-5.2 十分之一

动察 Beating AI 快讯,白天认领 Ox Alpha 后,智谱晚上正式开源 GLM-5.3-Flash,模型权重已经上线 Hugging Face,采用 MIT 许可。它总参数 320B,但每次只激活 18B,原生支持文字、图片和视频,也是 GLM-5 系列首个原生多模态模型。 官方称,GLM-5.3-Flash 整体性能超过 GLM-5.2,编程和 Agent 评测已经接近 Claude Opus 4.8,但价格只有 GLM-5.2 的十分之一。它还换了一套新的基础模型,首次在 GLM 主系列引入稀疏注意力和线性注意力混合架构,并用 30T Token 多模态数据预训练。 此前社区对 Ox Alpha 的 DeepSWE 小样本测试一度跑出 80%,但那只有 10 道题。扩大样本后成绩回落到约 63%,测试者也主动纠正了最初的说法。这个成绩依然属于第一梯队,但没有最初 80% 那么夸张。 权重开源后,开发者可以直接用 vLLM、SGLang、KTransformers 等框架自己部署,不需要再走匿名模型的 API。

09-11 12:57

GLM-5.3-Flash 免费体验即将收官,1 折特惠无缝接棒

ChainCatcher 消息,B.AI 宣布 GLM-5.3-Flash 限时免费体验即将告一段落,1 折专属调用特惠将于 9 月 12 日 10:00(SGT)起无缝接棒,用户仅需支付原价的 10%,直接节省 90%,输入低至 $0.015/M、输出低至 $0.05/M。作为原生全模态大模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,结合稀疏与线性注意力混合架构及 1M 超长上下文,在编程开发、智能体、长上下文处理及高频 API 工作负载等场景下表现强劲。B.AI 始终践行算力普惠愿景,坚持低门槛接入,致力于以极具竞争力的价格,让每一位开发者都能无负担使用顶级算力,告别高昂成本,全速推进创新落地。