「欧洲主权AI」不装了?Mistral直接把智谱GLM-5.2请进门
相关推荐
“千问办公”首发上线GLM-5.3、DeepSeek V4 Pro两款模型
火星财经消息,8月15日,阿里巴巴旗下Agent产品“千问办公”首发上线GLM-5.3和DeepSeek V4 Pro两款前沿模型。即日起,用户可在产品首页的“前沿模型”档位直接选用。加上此前首发上线的Qwen3.8-Max,千问办公目前已支持三款国产旗舰模型。
网传DeepSeek Harness本周开启内测,对标Claude Code
BlockBeats 消息,7 月 28 日,据 Max For AI 爆料,名为「Harness」的 DeepSeek 版 Claude Code 即将开始内测。社群疯传的内测招募截图显示,DeepSeek Harness 计划于本周晚些时候开启内测,首批用户将从小范围群聊中筛选。入选者需要提交个人资料、签署《保密承诺函》,并获得产品访问权限。 更值得注意的是,图里还明确提醒:一旦泄密,不仅会被取消资格,还会影响之后 DeepSeek 各类模型、产品内测以及合作机会的入选。如果消息属实,V4 正式版和 Harness 将很快公布。 动察 Beating 稍早前报道,DeepSeek V4 正式版(V4 GA)可能推迟到 8 月中旬发布。Harness 封闭测试结束后约 1 至 2 周会开放 V4,发布时间可能在 8 月 10 日至 20 日之间。如果消息属实,DeepSeek V4 上线时可能会面对更强竞争。届时 GPT-6、Claude Fable 5.1、GLM-5.5 等下一代模型可能已经进入市场。 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。
Anthropic首次点名智谱,指责GLM-5.2蒸馏Claude和OpenAI模型
据 动察 Beating 监测,Anthropic 国家安全政策负责人 Tarun Chhabra 在阿斯彭安全论坛上首次点名智谱。他指控 GLM-5.2 蒸馏了 Claude 和 OpenAI 模型。 蒸馏是用强模型的回答训练另一个模型。技术本身很常见,争议在于是否绕过服务条款,大规模抓取竞争对手的输出。 Chhabra 称,中国头部 AI 实验室几乎都在蒸馏美国模型。Anthropic 每周正在封禁数百万个相关账号。美国前沿模型目前领先中国约 6 到 9 个月。他认为,若没有这类蒸馏,差距本可达到 12 到 18 个月。 此前 Anthropic 已点名 DeepSeek、月之暗面、MiniMax 和阿里。
观点:API蒸馏仅为RL垫脚石,GLM 5.2自主迭代可彻底摆脱美国模型依赖
据动察 Beating 监测,谷歌 TPU 软件工程师 Patrick Toulme 指出,外界对 GLM 5.2 靠蒸馏追平 Opus 的说法存在误解。大模型在智能体编码任务上的训练难点在于「零梯度困境」,即模型早期若无法产生正确运行路径,强化学习便无法获得梯度信号来启动参数更新。蒸馏 Claude 或 GPT-5.5 的作用,仅仅是在冷启动阶段提供种子解答以绕过零梯度困境。 一旦模型跨过冷启动门槛,后续的性能爬升将不再依赖蒸馏,而是完全依靠强化学习的爬山算法进行自我演化。Toulme 强调,GLM 5.2 已经具备独立产生成功路径的能力,完全可以通过强化学习自主迭代到更高级别,彻底摆脱对美国大模型的依赖。 Redis 创始人 Salvatore Sanfilippo 补充了另一条路径的可能性:虽然通过高能力模型引入推理模式(蒸馏)对于获取更好的 RL 信号非常有用,但 DeepSeek R0 的实践已经证明,即使在完全没有蒸馏播种的纯冷启动情况下,强化学习依然可以自主运转并取得突破。 同时他认为,若仍需越过冷启动门槛,大模型研发完全可以初步使用 DeepSeek-v3.2 等本土开源模型进行微调,而非必须依赖美国 API。
美团领投A轮,Mindverse总融资近5000万美元,将开源首个基于GLM 5.1的750B强化学习Agent模型
据动察 Beating 监测,AI 智能体研发商 Mindverse(心洲科技)宣布完成由美团领投的 A 轮融资,元禾璞华、韶音、变量资本及老股东跟投,累计融资近 5000 万美元,高鹄资本担任独家财务顾问。Mindverse 由陈锴杰与 Andrew(曾与姚顺雨合作发表 ReAct / FireAct 论文)共同创立,核心研发团队来自 DeepSeek、字节 Seed、xAI 等,致力于通过后训练和持续学习技术构建原生智能体模型(Agent Model)。 与依赖外部 Prompt 拼接的常规做法不同,Mindverse 坚信智能体的核心能力来自于模型的「后训练」(Post-Training)。公司以 LoRA 为构建持续学习与参数化记忆的技术底座,在 2025 年底实现了万亿参数 MoE 模型的无损 LoRA 强化学习,将后训练成本降至全参数训练的十分之一。通过 Mixture of LoRA 架构,成千上万个代表不同偏好或业务经验的独立「技能包」(LoRA)可挂载在共享底座上,支持动态快速激活(秒级)与干净的隐私隔离。 Mindverse 宣布将开源其最新训练的 750B 参数 Agent 模型,该模型包含 744B 预训练 GLM 5.1 底座与 6B 的 LoRA,是全球首个在 GLM 5.1 上完成强化学习后训练的成果,在 Living Bench、Vita Bench、A2UI 及 PinchBench 四大榜单中均取得 SOTA。产品上,Mindverse 采用模型训练与 C 端生活 Agent 应用 Macaron(200 万用户,10 万日活)协同迭代的双向飞轮;商业上则与华为云、微软云等深度合作,将低成本高并发的 LoRA 训练与推理基础设施向企业开放。
ZCode免费送1亿GLM-5.3 Token,太火导致上线一小时就暂停
据动察 Beating 监测,智谱旗下编程 Agent 工具 ZCode,给 GLM-5.3 推出了一场周末免费活动。新用户首次登录 ZCode,即可获得 1 亿 GLM-5.3 Token,用于 AI 编程、代码修改和 Agent 任务。 活动原定北京时间 8 月 16 日 0 点开始,持续到 17 日上午 9 点。结果上线一小时,ZCode 就宣布暂停新增 1 亿 Token 发放。官方称活动需求「超出预期」,正在调整服务容量。 已经领取的额度不受影响,普通新用户的 300 万 GLM-5.3 Token 福利仍然开放。ZCode 表示,等容量恢复后会重新开启 1 亿 Token 活动。