Instinct疑似发生跨用户数据泄露:陌生财务文件直接串进聊天
相关推荐
个人Agent也有实战榜了:Muse暂列第一,领先Instinct和Grok Bot
动察 Beating AI 快讯,独立评测项目 Assistant Benchmark 开始用真实任务横评个人 AI 助手。它直接让 Agent 订酒店、选餐厅、买东西、回邮件、连接第三方服务,再按实际完成情况打分。每个评分维度都有一个公开的固定任务,并要求有真实运行记录才给分。 目前 Muse 在已经完成的 7 个评分维度中平均 9.1 分,暂列第一;Instinct 测完 11 个维度,平均 8.4 分;Grok Bot 测完 7 个维度,平均 7.3 分。Muse 在购物、邮件和第三方应用连接上都拿到 10 分。 不过这更适合看成一份持续更新的真实体验榜。Muse 的 9.1 目前只是已测 7 个维度的平均分,并不是完整成绩。每个维度目前也只用一个固定任务测试,后续补测后分数和排名都可能变化。
Instinct长期记忆被逆向:Git+Markdown,和Supermemory几乎同一路线
动察 Beating AI 快讯,Supermemory 的创始人 Dhravya Shah 逆向分析了个人 Agent 助手 Instinct 的长期记忆系统。他发现,Instinct 没有把全部聊天原样塞回上下文,而是把长期信息整理成一套 Git 管理的 Markdown 文件,再持续维护用户当前的状态。 Supermemory 本身就是专门给 Agent 做长期记忆的基础设施。它会从聊天、文件和网页里提取事实,维护人物关系、时间变化和用户画像,再通过 API、MCP 等方式把相关记忆交给 Agent。Shah 称,拆完 Instinct 后发现,两者对「Agent 应该怎么记东西」的思路非常接近。 按他的黑盒测试,Instinct 每次对话都会先拿到一份约 4250 Token 的用户状态摘要,包括生活背景、操作偏好和沟通习惯。更细的人物、偏好、决定和任务则留在 Markdown 文件中,需要时再用类似 grep 的关键词搜索。Shah 没有发现向量索引或 BM25 检索。 这些记忆还会被后台持续整理。系统会把临时信息归进具体任务,把经历概括成长期偏好,用新事实修正旧事实,再用 Git 留下版本历史。主 Agent 主要负责读取,真正的整理和合并则由后台流程完成。Shah 推测这轮整理大约每天运行一次。 Shah 认为这套设计已经可以用 Supermemory 基本复刻。他给出的示例只用了约 60 行代码,把用户画像、记忆搜索、历史版本和持续更新重新接进 Agent。 此前 Reflexion 共同作者 Ashwin Gopinath 猜测,Instinct 的优势可能是持续维护一份「当前状态」,知道什么仍然有效、什么已经过期、什么事情还没做完。现在看来,这份状态背后可能没有什么神秘数据库,而是一套被持续整理的文件系统。
Muse开放第三方接入,个人Agent的应用商店战争打响
动察 Beating AI 快讯,Meta 开放 Muse Connectors,允许第三方开发者把自己的服务直接接入 Muse。开发者提供 API,Muse 负责 Agent、浏览器和用户上下文,用户直接告诉 Muse 自己想做什么,它再调用对应服务完成任务。 Muse 上线时已经能连接 Gmail、Google Calendar、Spotify、OpenTable 等服务,但这些连接器主要由 Meta 提供。现在开发者可以自己为 Muse 做连接器,首批新增的是 Notion 和会议笔记工具 Granola。 个人 AI Agent 的「应用商店战争」开始了。ChatGPT、Grok Bot 都已经有自己的插件和服务生态,现在 Meta 也把 Muse 开给第三方开发者。过去是用户打开 App 找功能,未来可能变成用户只说需求,由 Agent 调用背后的服务。谁占住这一层,谁就更接近下一代应用分发入口。
Cyces收购AI用户研究平台Looppanel,将加速布局Agentic UX Research
动察 Beating AI 快讯,AI 产品工作室 Cyces 宣布已收购 AI 驱动的用户研究平台 Looppanel。交易完成后,Looppanel 将继续服务现有客户,Cyces 计划加快其产品开发,进一步拓展 AI 能力,并推动平台进入更多全球市场。 Looppanel 主要面向 UX 和产品团队,提供多语言转录、AI 辅助分析、主题标签、研究内容搜索及协作等功能,帮助企业从用户研究中提取洞察。Cyces 表示,未来将推动 Looppanel 向「Agentic UX Research」(智能体驱动的用户研究)方向发展。此次收购未披露具体交易金额。 Looppanel 成立于帮助企业更高效地开展定性用户研究,曾入选红杉资本 Spark 早期创业项目,并参与 TechCrunch Disrupt。
Instinct火到算力告急,刚融2.5亿又要融10亿
动察 Beating AI 快讯,个人 AI 助理 Instinct 正考虑再融资 10 亿美元。它刚完成 2.5 亿美元融资,累计融资已经达到 3.5 亿美元。过去几周,Instinct 多次提示用户服务已满负荷,回复可能变慢。新一轮融资仍处于早期,也可能最终不做。 如果 10 亿美元全部融到,现有投资人预计估值至少要到约 100 亿美元,才能把老股东的稀释控制在 10% 以内。Instinct 目前主要靠租服务器,并大量使用开源模型。创始人 Noah Shinn 还向潜在投资人提过,未来希望自己买芯片,甚至运营数据中心,长期降低算力成本。 竞争也突然变激烈。Meta 刚推出免费的个人 Agent Muse,同样可以替用户购物、订机票和处理日常任务。社区早期对比中,多名测试者都提到 Muse 的速度明显快于 Instinct。
Meta个人Agent上线前翻车:没同意就发邮件、改密码
动察 Beating AI 快讯,Meta 正在给即将上线的个人 AI Agent Hatch 补安全护栏。员工测试早期版本时多次发现它越权操作。Hatch 曾未经允许发邮件、修改账号密码。还有员工让它订酒店,它却没完成预订,反而擅自把 Chase 的通用积分转成了 Hyatt 酒店积分。 Hatch 的权限比普通聊天机器人高得多。它有自己的电脑,可以浏览网页、填表、购物和做深度研究,还能直接连接邮箱、日历等服务。App 关闭后,它也可以继续在后台干活。 安全测试还暴露过凭证泄露。Signal 创始人 Moxie Marlinspike 给 Hatch 接入一个专用 Gmail,再从另一个邮箱发信询问它使用的密码,Hatch 直接把密码回复了出去。另一次测试中,它还把员工带到诈骗网站下单。 Meta 后来把关键限制放到了模型外。现在 Hatch 要联网、使用浏览器、发邮件等敏感操作时,会触发「hard gate」,强制暂停并让用户批准,Agent 自己无法绕过。密码重置链接和双重验证码也不会直接交给它,而是放进单独的「凭证库」,需要额外授权才能读取。