返回 7*24 快讯
来源MarsBit

美团领投A轮,Mindverse总融资近5000万美元,将开源首个基于GLM 5.1的750B强化学习Agent模型

据动察 Beating 监测,AI 智能体研发商 Mindverse(心洲科技)宣布完成由美团领投的 A 轮融资,元禾璞华、韶音、变量资本及老股东跟投,累计融资近 5000 万美元,高鹄资本担任独家财务顾问。Mindverse 由陈锴杰与 Andrew(曾与姚顺雨合作发表 ReAct / FireAct 论文)共同创立,核心研发团队来自 DeepSeek、字节 Seed、xAI 等,致力于通过后训练和持续学习技术构建原生智能体模型(Agent Model)。 与依赖外部 Prompt 拼接的常规做法不同,Mindverse 坚信智能体的核心能力来自于模型的「后训练」(Post-Training)。公司以 LoRA 为构建持续学习与参数化记忆的技术底座,在 2025 年底实现了万亿参数 MoE 模型的无损 LoRA 强化学习,将后训练成本降至全参数训练的十分之一。通过 Mixture of LoRA 架构,成千上万个代表不同偏好或业务经验的独立「技能包」(LoRA)可挂载在共享底座上,支持动态快速激活(秒级)与干净的隐私隔离。 Mindverse 宣布将开源其最新训练的 750B 参数 Agent 模型,该模型包含 744B 预训练 GLM 5.1 底座与 6B 的 LoRA,是全球首个在 GLM 5.1 上完成强化学习后训练的成果,在 Living Bench、Vita Bench、A2UI 及 PinchBench 四大榜单中均取得 SOTA。产品上,Mindverse 采用模型训练与 C 端生活 Agent 应用 Macaron(200 万用户,10 万日活)协同迭代的双向飞轮;商业上则与华为云、微软云等深度合作,将低成本高并发的 LoRA 训练与推理基础设施向企业开放。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-15 13:31

“千问办公”首发上线GLM-5.3、DeepSeek V4 Pro两款模型

火星财经消息,8月15日,阿里巴巴旗下Agent产品“千问办公”首发上线GLM-5.3和DeepSeek V4 Pro两款前沿模型。即日起,用户可在产品首页的“前沿模型”档位直接选用。加上此前首发上线的Qwen3.8-Max,千问办公目前已支持三款国产旗舰模型。

08-13 20:52

DeepSeek Harness正式上线:首款Agent产品,整个Agent可实现自行组装

据 动察 Beating 监测,DeepSeek 正式上线首款 Agent 产品 DeepSeek Harness,软件包已经发布至 npm。此前 V4-Flash 的公开 Code Agent 评测,用的就是 Harness 内置的极简模式。 它不只是一款类似 Codex 的 Coding Agent。Harness 支持管理项目、长任务、多 Agent、Skill、联网搜索和上下文管理,还允许用户创建不同的「Agent 预设」。写代码、研究、写作等任务,可以配置不同的工具、提示词和工作方式。 更特别的是插件系统。DeepSeek 把「Everything is a plugin」作为核心设计,模型、工具、提示词、存储、上下文甚至界面都能通过插件替换或组合。内测用户已经做出了长期记忆、界面修改等插件。 简单说,Codex 更像一个做好的 Agent,DeepSeek Harness 更像一套组装 Agent 的运行时。用户不只是在选模型,也可以自己决定 Agent 用什么工具、遵守什么规则、怎么工作。

08-15 11:14

DeepSeek-V4-Pro被曝「一个API三个模型」?社区测试揭示背后或是Agent环境差异

BlockBeats 消息,8 月 15 日,近日 AI 社区热议 DeepSeek-V4-Pro 疑似存在多个版本。有用户发现,同样调用 deepseek-v4-pro 接口,在更换 IP 或重新创建会话后,模型会出现三种不同的「推理风格」: 一类频繁以「Let me」开头,接近此前 V4 Pro Preview;一类常出现「The user wants me」,类似 V4 Flash;另一类大量使用「we」,被部分用户称为能力更强的「神版 V4 Pro」。 由于同一会话一旦进入某种模式后,后续表现通常保持稳定,社区一度猜测 DeepSeek 是否在 API 背后隐藏了多个模型,并通过路由机制分发。不过,进一步分析 DeepSeek Harness 源码后,出现了另一种解释:差异可能并非来自不同模型权重,而是来自 Agent 运行环境。 社区发现,8 月 10 日,DeepSeek Harness 官方仓库更新了一条关键 commit: 「fix(preset): align minimal agent with RL composition」 该更新旨在让 Minimal Agent 与强化学习(RL)训练时使用的 Agent 环境保持一致。 官方文档显示,Minimal preset 包含极简 system prompt、persistent Bash 环境、指定编辑工具、RL 训练使用的 compaction policy,并移除了额外身份提示、Web 提示及工具说明。 这意味着,DSH Minimal 可能并不是 Standard 版本的「阉割版」,而是在模拟模型训练阶段真实接触的 Agent 环境。 社区测试也支持这一观点。同一个 DeepSeek V4 Pro 在不同 Harness 环境下表现: DSH Standard:91 分; DSH PTC:92 分; DSH Minimal:99/96 分。 随后,测试者开发「Anchored Standard」插件:首次请求模拟 Minimal 环境,只开放 shell 和 read 工具,完成首次工具调用后再恢复 Standard 完整工具集,结果连续获得 98/99 分。 测试者认为,决定 V4 Pro Agent 能力发挥的关键,可能并非最终拥有多少工具,而是模型首次看到的:System Prompt + Tool Schema + Agent

07-04 12:30

Moonbeam 将转型为 AI Agent 通信与结算网络,GLMR 迁移至 Base

火星财经消息,波卡平行链 Moonbeam 宣布,将推出全新的 Moonbeam 协议,转型为面向未来链上经济的去中心化 AI Agent 通信与结算网络。同时,GLMR 代币将以 1:1 比例迁移至 Base,成为原生 ERC-20 代币。跨链迁移现已开放,截止日期为 2026 年 7 月 31 日。官方表示,在中心化交易所持有 GLMR 的用户无需进行任何操作。

08-16 09:02

ZCode免费送1亿GLM-5.3 Token,太火导致上线一小时就暂停

据动察 Beating 监测,智谱旗下编程 Agent 工具 ZCode,给 GLM-5.3 推出了一场周末免费活动。新用户首次登录 ZCode,即可获得 1 亿 GLM-5.3 Token,用于 AI 编程、代码修改和 Agent 任务。 活动原定北京时间 8 月 16 日 0 点开始,持续到 17 日上午 9 点。结果上线一小时,ZCode 就宣布暂停新增 1 亿 Token 发放。官方称活动需求「超出预期」,正在调整服务容量。 已经领取的额度不受影响,普通新用户的 300 万 GLM-5.3 Token 福利仍然开放。ZCode 表示,等容量恢复后会重新开启 1 亿 Token 活动。

08-13 15:14

「韩模之光」Solar Pro4智能指数冲到42分,但还是打不过DeepSeek V4Flash

据动察 Beating 监测,韩国 AI 公司 Upstage 发布旗舰推理模型 Solar Pro 4。Artificial Analysis 最新评测中,它的智能指数从上一代 Solar Pro 3 的 14 分冲到 42 分,主要提升来自 Agent 和长上下文能力。 其中 Terminal-Bench v2.1 从 12% 升到 57%,长上下文推理从 31 升到 71。GDPval-AA v2 也从 498 Elo 升到 1277,超过 1000 的人类基线。Solar Pro 4 已经是韩国模型冲击全球前列的一张代表牌。 但放到 DeepSeek V4 Flash 0731 面前,还是不够看。同一套 Artificial Analysis 智能指数里,DeepSeek 拿到 52 分,比 Solar Pro 4 高 10 分。DeepSeek 每秒输出约 122 个 Token,Solar Pro 4 约 65 个,前者接近快一倍。 价格差距更大。Solar Pro 4 每百万 Token 输入、输出分别要 0.30 和 1.20 美元,DeepSeek 只要 0.14 和 0.28 美元。Solar 的输出价格超过 DeepSeek 的 4 倍。 至少按这套综合评测和 API 性价比,「韩模之光」还没追上 DeepSeek。