YC开源内部多Agent平台QM,让公司拥有自己的AI员工团队
相关推荐
Hermes Agent跟进Grok Bot:把多Agent做成普通人也能用的AI团队
据动察 Beating 监测,Nous Research 开始公测 Hermes Agent 的 Bot Mode。目前先以独立插件提供,收集反馈后计划整合进 Hermes Desktop。 Hermes 原本就支持多个独立 Profile,也能通过 Kanban 让不同 Agent 分工协作。Bot Mode 这次没有重做底层,主要是把这些能力重新做成一个更直观的产品界面。官方直接写明,一个 Bot 本质上就是一个 Hermes Profile。 现在每个 Profile 都会显示成一个有名字、头像和身份的 Bot。它们各自保留模型、Skill、记忆和聊天记录。用户可以直接 @ 另一个 Bot 派活,Bot 之间也有固定收件箱,可以互相发消息。每个 Bot 还能单独设置定时任务。 这套产品形态明显在跟进刚上线的 Grok Bot。社区有人直接问,这是不是补上了 Hermes 相比 Grok Bot 缺少的功能,Hermes 联合创始人 Teknium 回答「Yep」。
Claude Code跑Kimi K3最贵最慢,成本是Hermes Agent近4倍
据动察 Beating 监测,AI Agent 基础设施公司 Composio 扩大测试,把同一款 Kimi K3 接入 6 套 Agent 框架,完成 26 项相同任务。这里比较的是运行框架,底层模型均为 Kimi K3。 Kimi Code 完成 21 项排名第一。Hermes 完成 20 项,Pi Agent 和 Claude Code 均为 19 项,OpenCode 为 18 项,Codex 以 17 项垫底。 按 Kimi K3 官方价格估算,Hermes 和 Pi Agent 平均每项任务成本最低,分别为 0.39 美元和 0.40 美元。Claude Code 达到 1.47 美元,约为 Hermes 的 3.8 倍。 Pi Agent 速度最快,单项任务中位耗时为 161.7 秒。Claude Code 最慢,达到 347.6 秒。同一模型换套框架,成功数最多只差 4 项,平均成本却相差近 4 倍,耗时相差超过 2 倍。
OpenClaw基金会正式运营,腾讯与OpenAI英伟达微软同列首批伙伴
据动察 Beating 监测,开源个人 AI agent 项目 OpenClaw 宣布,其非营利基金会 OpenClaw Foundation 已正式运营。 OpenClaw 是一个跑在用户自己设备上的个人 AI 助手。它可以接入邮件、日历、聊天工具和本地应用,让 AI 直接替用户完成任务。 基金会将负责 OpenClaw 的治理、资金、社区和长期维护,确保项目继续保持开源和独立。 官方称,OpenClaw 仍将保持 MIT 许可。Peter Steinberger 会继续负责项目方向,尤其是技术决策。OpenAI 也承诺支持 OpenClaw 作为开放独立项目运行。 首批合作伙伴包括 OpenAI、英伟达、微软、密歇根大学、GitHub、Cloudflare、Vercel 等。中国公司腾讯也在名单中,主要参与安全、部署和基础设施相关支持。
HermesTrade 正式上线:Monad 首个原生预测市场,将支持 AI Agent 策略交易
HermesTrade 现已正式上线(hermestrade.xyz)。作为构建于 Monad 之上的首个原生预测市场,其核心团队具备专业做市背景,为平台提供充足的交易流动性与订单簿级执行体验。HermesTrade 将支持 AI Agent 策略交易,实现自主分析、对冲与结算。适逢世界杯开赛,平台已同步上线相关赛事市场,为体育预测提供实时交易场景。
Hermes v0.16.0正式版:桌面端支持远程OAuth网关与网页配置
据动察 Beating 监测,Nous Research 发布了开源 AI 智能体框架 Hermes Agent v0.16.0 (v2026.6.5) 正式版。继日前桌面端预览版发布后,新版本通过远程网关连接和网页配置化,将 Hermes 框架正式推向生产力阶段。核心升级是桌面端引进了基于 WebSocket 的远程网关连接,支持通过 OAuth 或用户名密码进行安全校验。用户可以在轻量笔记本上运行桌面图形界面,而把高额的 AI 算力和 API 密钥托管于远程服务器或家庭实验室。 网页端控制面板也同步升级为全功能的后台管理系统。用户无需再通过 SSH 登录服务器去手动编辑 config.yaml 配置文件,即可直接在浏览器里启用或禁用 MCP 工具目录、绑定 Telegram、Discord、Slack 等即时通讯渠道、管理凭据与 Webhooks、以及调整系统内存。同时,为了服务中文开发者,新版本为桌面端提供了完整的简体中文本地化支持。 在核心逻辑与易用性上,默认技能集也完成了精简,移除了冗余和已失效的工具,以减轻模型的上下文负担,并内置了 NVIDIA/skills 受信任 Tap。新版本还上线了可在桌面、Web、TUI 和 CLI 界面通用的模糊搜索模型选择器,并引入了支持回滚 N 轮对话并重新编辑的 /undo 撤销指令,进一步提升了人机协作的容错率。
Pi重构Agent执行层:长任务开始走向持久化运行
据动察 Beating 监测,Pi 正在重做 Agent Harness。最新 Harness v3 规范已经写完,正在做最终审计。它重做了任务执行和存储,让 Agent 即使跑到一半进程崩溃,甚至 Harness 自己升级,也能从中断处继续。 Pi 是 Mario Zechner 创建的开源 Agent Harness,最早因为 OpenClaw 使用它而出圈。项目今年被 Earendil 收购,Mario 也加入公司继续负责开发。现在 Pi 已有超过 6 万 GitHub Star,MiniMax 最新的 MiniMax Code 也明确基于 OpenCode 和 Pi 搭建 Harness。 v3 这次直接重做了底层架构。模型请求和工具调用前都会先保存执行状态,完成后再写入结果。重启后,Pi 能知道哪些已经做完、哪些可以重跑、哪些有副作用不能再执行一次。对话、运行状态和 Token 成本也改成分开保存,并加入跨版本状态迁移。 Claude Code、Codex 都在把 Agent 往更长的任务推。OpenAI 已经专门研究怎么让 Codex 持续完成长时间工作,Anthropic 也称 Claude Code 正越来越多地被用于长时间运行的 Agent 任务。Agent 能连续干几小时以后,前面几小时就不能因为一次崩溃全部白干。