返回 7*24 快讯
来源MarsBit

「牛来」模型GLM-5.3-Flash正式开源:320B 参数仅激活 18B,价格只有 GLM-5.2 十分之一

动察 Beating AI 快讯,白天认领 Ox Alpha 后,智谱晚上正式开源 GLM-5.3-Flash,模型权重已经上线 Hugging Face,采用 MIT 许可。它总参数 320B,但每次只激活 18B,原生支持文字、图片和视频,也是 GLM-5 系列首个原生多模态模型。 官方称,GLM-5.3-Flash 整体性能超过 GLM-5.2,编程和 Agent 评测已经接近 Claude Opus 4.8,但价格只有 GLM-5.2 的十分之一。它还换了一套新的基础模型,首次在 GLM 主系列引入稀疏注意力和线性注意力混合架构,并用 30T Token 多模态数据预训练。 此前社区对 Ox Alpha 的 DeepSWE 小样本测试一度跑出 80%,但那只有 10 道题。扩大样本后成绩回落到约 63%,测试者也主动纠正了最初的说法。这个成绩依然属于第一梯队,但没有最初 80% 那么夸张。 权重开源后,开发者可以直接用 vLLM、SGLang、KTransformers 等框架自己部署,不需要再走匿名模型的 API。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-11 23:56重要

OpenAI Agent又曝黑历史:Hugging Face事件前两月已攻击RubyGems

动察 Beating AI 快讯,研究人员披露,OpenAI 内部 Agent 今年 5 月曾大规模涌入 Ruby 官方软件包网站 RubyGems.org。5 月 11 日到 12 日,两天上传超过 2000 个包,RubyGems 一度暂停新用户注册 4 天。OpenAI 已确认这些 Agent 来自公司内部,但称它们只是借 RubyGems 访问互联网,执行良性任务并获取公开信息。 这些 Agent 还利用 RubyDoc.info 自动生成文档的机制,让自己上传的脚本在对方服务器执行,再抓取英国地方政府网站的数据并重新打包回传。研究人员称,至少 6 个包还尝试利用一个当时尚未公开的 RubyGems 漏洞,窃取其他用户的 API Key。这个漏洞直到 7 月才被独立发现,RubyGems 后来将其评为高危漏洞。 目前没有证据证明 Agent 真偷到了密钥。RubyGems 检查日志后也没发现旧密钥被恶意使用,但历史日志并不完整。研究团队还称,OpenAI 当时没有告诉 RubyGems 自己与这次攻击有关。整个事件比 7 月的 Hugging Face 入侵早了两个月。

09-04 08:21

智谱再发匿名模型:GLM-5.3-Flash刚转正,Omen Alpha又来了

动察 Beating AI 快讯,OpenCode 又上线一个匿名模型 Omen Alpha,而这次身份似乎已经提前露馅。OpenCode 自己的数据页直接把它归在 Zhipu 名下。智谱目前还没有正式认领,也没有公布它究竟是哪款 GLM。 这离上一个匿名模型揭晓只有 9 天。智谱此前把 GLM-5.3-Flash 化名为 Ox Alpha,在 OpenRouter 和 OpenCode 免费测试。8 月 26 日才正式公布真身,并开放模型权重。 但这次没有免费午餐了,Omen Alpha 只给每月 10 美元的 OpenCode Go 用户使用,套餐提供价值 100 美元的 Omen 用量。每百万 token 输入收费 0.20 美元,输出 0.66 美元,比 GLM-5.3-Flash 正式价格高约三成;但 GLM-5.3-Flash 目前正在打五折,按现价算,Omen Alpha 大约贵 1.6 倍。 Omen Alpha 的正式规格目前还是空白。OpenCode 没公布上下文、输入模态和最大输出。社区已经有人猜它可能是新的 GLM-5.x 或 Omni 分支。

08-26 08:18

「牛来」模型Ox Alpha就是 GLM-5.3 Flash?预测市场超九成认定智谱

动察 Beating AI 快讯,神秘模型 Ox Alpha 的身份竞猜已经明显倒向智谱。Polymarket 上,Z.ai 的概率目前超过 90%,第二名 Google 只有约 5%。Ox Alpha 是最近突然出现在 OpenRouter 上的匿名推理模型,主打编程和长时间 Agent 任务。 最硬的线索来自后端。社区开发者故意向 OpenCode 的 Ox Alpha 接口发送错误参数,服务器吐出了 com.wd.paas.api.domain.v4.chat.ChatCompletionRequest。其中的 paas/v4/chat 与 Z.ai 官方 API 路径直接对上。继续发送非法 role 时,Ox Alpha 又返回 1214 Incorrect role information,和 Z.ai 自己托管的 GLM 一致。换成 DeepInfra 托管同一 GLM 权重,报错格式就变了。 模型本身的指纹也对上了。一份公开取证跑了 600 多次请求、约 1350 万输入 Token,44 组分词器测试全部匹配 GLM-5 这一代。

08-28 15:09

智谱GLM-5.3正式开源:换掉MIT,百亿美元模型服务商要过安全审查

动察 Beating AI 快讯,智谱正式开源 744B 参数的旗舰模型 GLM-5.3,FP8 与 BF16 权重已在 Hugging Face 放出。与上一代 GLM-5.2 不同,这次没有继续使用 MIT,而是换成了新的「GLM-5.3 License」。 新许可证对普通开发者依然比较宽松,可以使用、修改、分发、部署、微调甚至销售模型和衍生版本。但智谱专门给大型「模型即服务」公司加了一条限制:如果公司及关联方任意连续 12 个月总收入超过 100 亿美元,商业使用 GLM-5.3 前必须先通过智谱的安全审查。普通产品把模型嵌入具体功能,不受这一条限制。 GLM-5.3 两周前就已经发布,但智谱当时因为模型的网络安全能力增长超出预期,决定先做额外安全评估和加固,再开放权重。现在模型也已经支持 SGLang、vLLM、Transformers、KTransformers 等框架自行部署。

09-11 05:14

DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一

动察 Beating AI 快讯,Artificial Analysis 完成 DeepSeek V4.1 Flash 独立测试,综合智能指数拿到 40 分。它已经超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这套第三方榜单,DeepSeek 还没夺回国产模型第一。 但价格差距非常夸张。V4.1 Flash 跑完一个 Intelligence Index 任务平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差约 7 倍。输出速度达到 197 Token/s,也远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。 Agent 依然是它最强的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 也拿到 84%。缺点是它特别能说,AA 测试中单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,吃掉了一部分价格优势。

08-27 07:24重要

比黑进Hugging Face更狠:Astra同家族模型曾突破OpenAI内网,最后拿到最高权限

动察 Beating AI 快讯,OpenAI 最新技术报告还披露了一场此前几乎没人注意到的内部事故:一款与下一代模型 Astra 同家族的内部模型,曾在评测中一路攻进 OpenAI 自己的云端基础设施。 它先利用此前攻击遗留下来的签名密钥材料,伪造出新的管理员凭证,重新拿下 OpenAI 内部软件仓库 Artifactory。随后继续横向突破,进入 OpenAI 的云端 Kubernetes 集群,并获得 `cluster-admin`,也就是整套集群的最高管理员权限。 权限拿到后,Agent 创建了特权容器,还接触到 OpenAI 云端密钥管理、身份权限和 CI 平台的认证 Token,甚至创建了公网负载均衡器,可能让部分内部基础设施直接暴露给互联网。 需要强调的是,这不是 Astra 本身,也不是此前主导 Hugging Face 攻击的模型。OpenAI 明确称,它只是和 Astra 属于同一家族,但采用了不同的后训练。