LongCat-2.0正式发布不足一月,美团基础模型负责人裴鹏将离职
相关推荐
美团开源万亿参数大模型LongCat-2.0,同步开放中国国产卡推理代码
据动察 Beating 监测,美团正式开源万亿参数大模型 LongCat-2.0,总参数 1.6T,平均激活约 48B,专为真实 Agentic Coding 任务设计。架构上创新引入 LongCat 稀疏注意力和 N-gram Embedding,前者通过流感知索引与层级化索引减少碎片化访存,加速百万级长上下文训练与推理;后者在 MoE 稀疏度已接近 97% 的情况下将 135B 参数投入嵌入层,兼顾参数收益与结构稳定性。后训练采用多教师在线蒸馏,将专家分为 Agent、推理和交互三类,通过 MOPD 架构在国产算力集群上无缝融合。作为业界首个在五万卡国产算力集群上完成推理的万亿参数模型,LongCat-2.0 验证了国产芯片承载复杂大模型任务的成熟能力。 针对中国国产芯片显存、带宽和互联的多重限制,美团从模型、芯片适配与部署三个方向逐一突破:模型层面通过 ScMoE 利用国产芯片控核能力实现 Dense 与 MoE 分支物理核心级并行,结合 KV-cache 切分缓解超长上下文显存压力;芯片适配层面以 Super Kernel 减少算子启动开销,通过 Weight Prefetch 隐藏 I/O 延迟,在受限条件下最大化硬件利用率;部署层面采用 PD 分离兼顾 TTFT 与 TPOT,配合异步化 Expert-Parallel 负载均衡解决大 EP 度下的负载不均。本次开源同步提供 BF16、FP8 及 INT8 等多精度版本,并将针对国产算力极致优化的推理成果完整开放,目标是让存量国产卡乃至老卡都能流畅部署万亿大模型推理服务。 --------------------------------- 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。
Hermes Agent跟进Grok Bot:把多Agent做成普通人也能用的AI团队
据动察 Beating 监测,Nous Research 开始公测 Hermes Agent 的 Bot Mode。目前先以独立插件提供,收集反馈后计划整合进 Hermes Desktop。 Hermes 原本就支持多个独立 Profile,也能通过 Kanban 让不同 Agent 分工协作。Bot Mode 这次没有重做底层,主要是把这些能力重新做成一个更直观的产品界面。官方直接写明,一个 Bot 本质上就是一个 Hermes Profile。 现在每个 Profile 都会显示成一个有名字、头像和身份的 Bot。它们各自保留模型、Skill、记忆和聊天记录。用户可以直接 @ 另一个 Bot 派活,Bot 之间也有固定收件箱,可以互相发消息。每个 Bot 还能单独设置定时任务。 这套产品形态明显在跟进刚上线的 Grok Bot。社区有人直接问,这是不是补上了 Hermes 相比 Grok Bot 缺少的功能,Hermes 联合创始人 Teknium 回答「Yep」。
DeepSeek Harness正式上线:首款Agent产品,整个Agent可实现自行组装
据 动察 Beating 监测,DeepSeek 正式上线首款 Agent 产品 DeepSeek Harness,软件包已经发布至 npm。此前 V4-Flash 的公开 Code Agent 评测,用的就是 Harness 内置的极简模式。 它不只是一款类似 Codex 的 Coding Agent。Harness 支持管理项目、长任务、多 Agent、Skill、联网搜索和上下文管理,还允许用户创建不同的「Agent 预设」。写代码、研究、写作等任务,可以配置不同的工具、提示词和工作方式。 更特别的是插件系统。DeepSeek 把「Everything is a plugin」作为核心设计,模型、工具、提示词、存储、上下文甚至界面都能通过插件替换或组合。内测用户已经做出了长期记忆、界面修改等插件。 简单说,Codex 更像一个做好的 Agent,DeepSeek Harness 更像一套组装 Agent 的运行时。用户不只是在选模型,也可以自己决定 Agent 用什么工具、遵守什么规则、怎么工作。
Hone想做企业Agent控制层:一个目标连续跑几个月
据动察 Beating 监测,Hone 正式亮相,团队成员来自 Cognition、Mercor、Ramp 和 OpenAI。它想做一套长期运行的企业 Agent 系统。 用户只需要给一个业务目标,比如「把新用户流失率降到 8%」。Hone 再负责拆任务、调度 Agent、修改软件,并根据企业数据持续调整。 它和普通 Agent 的区别,是不只执行一次任务,而是围绕同一个目标持续工作几周甚至几个月。官方把它形容成「更像 Kubernetes,而不是聊天机器人」。 不过目前主要还是技术路线发布。Hone 没有公布完整产品、价格或可验证的长期运行案例,实际效果还有待证明。
离开千问5个月,林俊旸亮相创业公司语用科技:主攻数字和物理世界Agent
据 动察 Beating 监测,前阿里千问技术负责人林俊旸正式公布创业公司 Pragmatik Labs,中文名「语用科技」,简称 p7k。公司位于上海,主攻横跨数字和物理世界的下一代 Agent。 目前官网还没有公布具体模型或产品。林俊旸同时确认,高榕创投和红杉中国共同领投本轮融资,腾讯和上海未来产业基金参与。 这笔融资早在今年 6 月就已曝光。《The Information》当时称,公司首轮融资数亿美元,高榕和红杉中国各投入约 1 亿美元,腾讯投入约 2000 万美元,投后估值约 20 亿美元。当时外界只知道林俊旸在创业,这次公司名字和具体方向才正式公开。
Pi重构Agent执行层:长任务开始走向持久化运行
据动察 Beating 监测,Pi 正在重做 Agent Harness。最新 Harness v3 规范已经写完,正在做最终审计。它重做了任务执行和存储,让 Agent 即使跑到一半进程崩溃,甚至 Harness 自己升级,也能从中断处继续。 Pi 是 Mario Zechner 创建的开源 Agent Harness,最早因为 OpenClaw 使用它而出圈。项目今年被 Earendil 收购,Mario 也加入公司继续负责开发。现在 Pi 已有超过 6 万 GitHub Star,MiniMax 最新的 MiniMax Code 也明确基于 OpenCode 和 Pi 搭建 Harness。 v3 这次直接重做了底层架构。模型请求和工具调用前都会先保存执行状态,完成后再写入结果。重启后,Pi 能知道哪些已经做完、哪些可以重跑、哪些有副作用不能再执行一次。对话、运行状态和 Token 成本也改成分开保存,并加入跨版本状态迁移。 Claude Code、Codex 都在把 Agent 往更长的任务推。OpenAI 已经专门研究怎么让 Codex 持续完成长时间工作,Anthropic 也称 Claude Code 正越来越多地被用于长时间运行的 Agent 任务。Agent 能连续干几小时以后,前面几小时就不能因为一次崩溃全部白干。