加密货币价格波动剧烈,本站内容仅供参考,不构成投资建议。投资有风险,可能导致全部损失。

查看完整免责声明
返回 7*24 快讯
来源MarsBit

蚂蚁发布大模型安全护栏SingProbe

火星财经消息,蚂蚁AI安全实验室正式发布大模型内生式安全护栏SingProbe,将安全检测融入模型生成过程。目前,SingProbe已适配Ling-3.0系列、GLM-5.2/5.3、Qwen、DeepSeekV4等29个主流开源大模型,并接入SGLang、vLLM推理框架,相关代码、模型和评测基准同步开源。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-27 04:23

Qwen3.8-Flash发布一天就降价:输出比GLM便宜0.1元,但对手还在打5折

动察 Beating AI 快讯,Qwen3.8-Flash 刚发布一天,阿里云就降价了。每百万 Token 输入从 1 元降到 0.8 元,输出从 3 元降到 2.7 元,分别下降 20% 和 10%。 新价格刚好压过昨天发布的 GLM-5.3-Flash。后者 API 标价为输入 0.8 元、输出 2.8 元。Qwen 输入价格相同,输出便宜 0.1 元。 不过 GLM-5.3-Flash 上线后前两周打 5 折,目前实际价格只有输入 0.4 元、输出 1.4 元。优惠期内,GLM 仍然便宜近一半。等优惠结束,两款国产 Flash 模型的价格基本打平。

08-28 15:09

智谱GLM-5.3正式开源:换掉MIT,百亿美元模型服务商要过安全审查

动察 Beating AI 快讯,智谱正式开源 744B 参数的旗舰模型 GLM-5.3,FP8 与 BF16 权重已在 Hugging Face 放出。与上一代 GLM-5.2 不同,这次没有继续使用 MIT,而是换成了新的「GLM-5.3 License」。 新许可证对普通开发者依然比较宽松,可以使用、修改、分发、部署、微调甚至销售模型和衍生版本。但智谱专门给大型「模型即服务」公司加了一条限制:如果公司及关联方任意连续 12 个月总收入超过 100 亿美元,商业使用 GLM-5.3 前必须先通过智谱的安全审查。普通产品把模型嵌入具体功能,不受这一条限制。 GLM-5.3 两周前就已经发布,但智谱当时因为模型的网络安全能力增长超出预期,决定先做额外安全评估和加固,再开放权重。现在模型也已经支持 SGLang、vLLM、Transformers、KTransformers 等框架自行部署。

08-26 14:15

「牛来」模型GLM-5.3-Flash正式开源:320B 参数仅激活 18B,价格只有 GLM-5.2 十分之一

动察 Beating AI 快讯,白天认领 Ox Alpha 后,智谱晚上正式开源 GLM-5.3-Flash,模型权重已经上线 Hugging Face,采用 MIT 许可。它总参数 320B,但每次只激活 18B,原生支持文字、图片和视频,也是 GLM-5 系列首个原生多模态模型。 官方称,GLM-5.3-Flash 整体性能超过 GLM-5.2,编程和 Agent 评测已经接近 Claude Opus 4.8,但价格只有 GLM-5.2 的十分之一。它还换了一套新的基础模型,首次在 GLM 主系列引入稀疏注意力和线性注意力混合架构,并用 30T Token 多模态数据预训练。 此前社区对 Ox Alpha 的 DeepSWE 小样本测试一度跑出 80%,但那只有 10 道题。扩大样本后成绩回落到约 63%,测试者也主动纠正了最初的说法。这个成绩依然属于第一梯队,但没有最初 80% 那么夸张。 权重开源后,开发者可以直接用 vLLM、SGLang、KTransformers 等框架自己部署,不需要再走匿名模型的 API。

08-05 07:38

蚂蚁Ling-3.0-flash正式开源,FP8版仅128GB

据动察 Beating 监测,蚂蚁百灵(inclusionAI)正式开放 Ling-3.0-flash 权重,同时提供 BF16 原版和 FP8 量化版。两版均采用 MIT 许可证,已上线 Hugging Face 和 ModelScope,可用 SGLang 或 vLLM 自行部署。 BF16 版权重约 255GB,FP8 版约 128GB,体积接近减半。FP8 用更低精度保存参数,可以降低存储和显存门槛。官方列出的 4 项测试中,FP8 与 BF16 的最大分差为 1.57 分。 Ling-3.0-flash 总参数 1240 亿,每次生成只激活 51 亿。模型支持 25.6 万 Token 上下文,主要面向编程、搜索、深度研究和工具调用等 Agent 任务。官方评测显示,它在多数基准上达到或超过万亿参数的前代模型 Ring-2.6-1T。

09-09 10:06

B.AI 延长 GLM-5.3-Flash 免费调用至 9 月 12 日

ChainCatcher 消息,9 月 9 日,智谱 GLM-5.3-Flash 官方调价即将生效。AI 模型调用平台 B.AI 宣布限时延长免费权益,即日起至 9 月 12 日 09:59(SGT),该模型在 B.AI 平台仍可全量免费调用。GLM-5.3-Flash 总参数 320B、激活参数 18B,支持 1M 上下文。Qwen3.8 Flash、Hy3、MiMo V2.5 等模型在 B.AI 平台仍保持免费开放。

08-21 03:27

GLM-5.3、DeepSeek-V4-Pro正式版接入千问AI平台

火星财经消息,8月21日,据阿里云消息,阿里云MaaS扩充模型服务矩阵,GLM-5.3和DeepSeek-V4-Pro正式版现已接入千问AI平台,相关API服务同步开放,开发者可直接调用。据介绍,DeepSeek-V4-Pro、Qwen3.8-Max和Qwen-Audio系列模型已陆续开放订阅使用,用户订阅套餐后,可在Qoder、Codex等AI工具中按需切换模型。