返回 7*24 快讯
来源Blockbeats

欧洲第一模型身份曝光:Quasar 438B基于智谱GLM-5.2

动察 Beating AI 快讯,西班牙 AI 公司 Multiverse Computing 刚把 Quasar 438B 宣传为「欧洲最强 AI 模型」,社区就扒出了它和智谱 GLM-5.2 的关系。Artificial Analysis 当前页面已经直接把模型标为「Quasar 438B (max, based on GLM-5.2)」,明确写着它基于 GLM-5.2。 Multiverse 自己的旧文档其实也早有线索。8 月 5 日 Quasar 438B 上线 beta 时,CompactifAI 更新日志写明,它的能力与 GLM-5.2「完全相同」。社区据此质疑,Quasar 是否只是把 GLM-5.2 压缩或改造后重新命名。Multiverse 目前没有公布架构、训练方式,也没有解释两者具体是什么关系。Multiverse 的主业就是模型压缩,但它自己的 FAQ 目前仍把 Quasar 列在「Original Models」,没有放进「Compressed Models」。 GLM-5.2 总参数约 753B,推理时激活 40B,Artificial Analysis 智能指数 max 档为 53 分;Quasar 缩到 438B 后只有 43 分,但输出速度约 174 Token/s,明显快于 GLM-5.2 的约 68 Token/s。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-05 11:13

Artificial Analysis重做智能榜:40%权重改用私有测试

动察 Beating AI 快讯,Artificial Analysis 更新 Intelligence Index v4.2,旨在让榜单更难被针对性刷分。私有测试权重从 20% 提高到 40%,模型厂商无法提前看到完整测试集,减少针对 Benchmark 专门优化的空间。 新版加入 AA-Briefcase 和 GDP.pdf。AA-Briefcase 模拟持续数周的真实知识工作项目,模型要处理大量关联任务和数千份文件。GDP.pdf 则拿 100 份、共 4592 页的专业 PDF 出题,要求模型跨文本、表格、图表和脚注找证据再回答。 GPQA Diamond 则被直接移出综合指数。这个研究生级科学问答测试已经接近饱和,GPT-6 Astra 最高达到 96.3%,Gemini 3.8 Flash 也达到 95.3%,已经很难区分最强模型。 重新计算后,Claude Fable 5.1 仍排第一,GPT-6 Astra 第二。Astra 得分 55,比 GPT-5.6 Sol 高 4 分。Artificial Analysis 还称,Astra 在同级前沿模型中用了更少的输出 Token。

09-11 05:14

DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一

动察 Beating AI 快讯,Artificial Analysis 完成 DeepSeek V4.1 Flash 独立测试,综合智能指数拿到 40 分。它已经超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这套第三方榜单,DeepSeek 还没夺回国产模型第一。 但价格差距非常夸张。V4.1 Flash 跑完一个 Intelligence Index 任务平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差约 7 倍。输出速度达到 197 Token/s,也远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。 Agent 依然是它最强的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 也拿到 84%。缺点是它特别能说,AA 测试中单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,吃掉了一部分价格优势。

09-05 15:35

Muse Spark 1.3 Max正式开放:最强推理档终于能用了

动察 Beating AI 快讯,Meta 正式开放 Muse Spark 1.3 Max。它是 Muse Spark 1.3 的最高推理强度,此前 1.3 发布时,max 还在做额外安全测试,只给少量合作伙伴预览。现在安全测试完成,已经能在 Muse Code 和 Meta Model API 里直接使用。 Meta 首席 AI 官 Alexandr Wang 称,Max 在编程和 Agent 任务上明显强于 high 和 xhigh。Artificial Analysis 的 Coding Agent Index 中,Muse Code + Muse Spark 1.3 Max 得到 68 分,已经进入第一梯队。

08-27 05:19

fal把MiniMax H3再训一遍:图生视频登顶,5秒视频3秒出片

动察 Beating AI 快讯,AI 推理平台 fal 发布 H3 Max。它是 fal 基于开源 MiniMax H3 后训练出来的视频模型,重点加强了提示词理解和画面效果,也专门针对自家推理系统做了加速。 在 Artificial Analysis 的带声音视频榜单中,H3 Max 图生视频以 1205 Elo 排名第一,超过字节 Seedance 2.0 和原版 H3;文生视频则以 1235 Elo 排第三,和第一名 Wan 3.0 只差 4 分。 速度也很夸张。fal 称,生成一段 5 秒 768p 视频不到 3 秒,吞吐量约为原版 H3 接口的 35 倍。目前首发打 5 折,768p 每秒只要 0.04 美元,生成 1 分钟视频只要 2.4 美元」;9 月 1 日后恢复到每秒 0.08 美元。 不过,H3 Max 的能力范围更窄。它目前最高只支持 768p,而原版 H3 可以生成 2K 视频;首发也只有文生视频和图生视频,Reference-to-Video(参考图生视频) 还没上线。

08-19 07:42

里昂:智谱GLM-5.3后训练能力显著提升,维持「跑赢大市」评级

BlockBeats 消息,8 月 19 日,里昂发表研究报告指,智谱 (02513.HK) GLM-5.3 API 即日起开放调用,在复杂编码及长周期代理任务方面展现国内同业中领先性能,虽然参数规模较小,但在一众基准测试中都取得开放权重 SOTA 表现,并在 Artificial Analysis 智能指数中获得 60 分,与 Kimi 3 持平,超越通义千问 3.8 Max。 该行估算 GLM 模型的 OpenRouter 收入份额已从今年 1 月的 1% 升至 7 月的 7%,领先 DeepSeek 的 6% 及月之暗面的 3%。认为 DeepSeek 近期加价反映行业竞争健康,而 GLM 5.3 已重夺帕累托前沿地位。 近期股价疲弱或反映市场对 Anthropic 年化经常性收入减速的过度反应,维持智谱「跑赢大市」评级,目标价为 2061 港元。(金十)

08-19 01:17

GLM-5.3智能指数暴涨到60:追平Kimi K3,API单价没涨

据动察 Beating 监测,智谱正式开放 GLM-5.3 API。此前模型发布时,API 没有立即上线。与此同时,Artificial Analysis 的独立评测也出炉了:Intelligence Index 从 GLM-5.2 的 53 暴涨到 60,追平 Kimi K3,只比 GPT-5.6 Sol 低 1 分。等权重按计划公开后,它将和 Kimi K3 并列 AA 评分最高的开放权重模型。 涨得最猛的是 Agent。GDPval-AA v2 的 Elo 从 1524 跳到 1770,一次涨了 246 分,排所有模型第二,仅次于 Claude Opus 5 的 1855,也比 Kimi K3 的 1668 高出 100 多分。 API 单价没有跟着涨。输入仍是每百万 Token 1.40 美元,输出 4.40 美元,缓存输入 0.26 美元,和 GLM-5.2 完全一样。 不过 5.3 明显更能花 Token。AA 测得它每项任务平均输出约 1.87 万 Token,比 5.2 多 20%。因此单任务实际成本从 0.44 美元涨到 0.68 美元,贵了约 55%。即便如此,同档模型里仍比 Kimi K3 的 0.84 美元和 GPT-5.6 Sol 的 1.23 美元便宜。