Muse上线一周,稳居美国免费榜第二:只输ChatGPT,超过Gemini和Claude
相关推荐
Meta Muse Code正式版上线:一个任务拉起一队Agent并行干活
动察 Beating AI 快讯,Meta 的终端编程 Agent Muse Code 正式结束 Beta。公测近一个月后,这次转正重点升级多 Agent 协作。复杂工程任务可以拆给多个专门 Agent,并行或分阶段完成。 不同 Muse Code 会话现在还能直接互相发消息。两个终端里的 Agent 如果在处理相互影响的任务,可以直接传递上下文和状态,不用开发者手动复制。Workflow 控制台会集中显示每个 Agent,也可以随时干预、停止或保存任务。 Meta 同时开放 Muse Code SDK 开发者预览。开发者可以把 Agent 嵌进自己的 App,连接自定义工具、实时返回进度,并在之后恢复会话。 Muse Code 也开始推出月订阅,价格从 5 美元起。
DeepSWE一夜两换榜首:Gemini刚上去,Meta又报75.4%
动察 Beating AI 快讯,Gemini 3.8 Flash 刚发布时,Google 在 DeepSWE v1.1 上跑出 73.7%。DeepSWE 官方榜目前将它显示为 74%±1%,排在 Claude Opus 5 和 GPT-5.6 Sol 前面。几个小时后,Meta 又公布 Muse Spark 1.3,自己在同一套 DeepSWE 上跑到 75.4%,把公开成绩再往上推了 1.7 个百分点。 这项测试让 Agent 独立处理 113 个真实代码库里的长周期软件工程任务。Google 和 Meta 都使用 mini-swe-agent,Google 跑的是 high 推理档,Meta 跑的是 max。Meta 上一代 Spark 1.2 只有 55.0%,这次直接涨了 20.4 个百分点。不过 Meta 的 75.4% 目前还没进入 DeepSWE 官方榜。 在 Artificial Analysis 的 Coding Agent Index 中,限量预览的 Spark 1.3 max 得到 68 分,仅次于 Claude Opus 5;目前公开可用的 xhigh 版本则是 64 分。
Meta发布Muse:把OpenClaw做成普通人直接能用的产品
动察 Beating AI 快讯,Meta 发布个人 Agent Muse。和 OpenClaw、Hermes 最大的区别是,不用自己部署,也不用折腾模型、服务器和 Skill。Meta 直接提供独立云端环境,打开 App、网页或 WhatsApp 就能用。 和 Grok Bot 相比,Muse 不强调同时养多个 Agent,更偏一个长期跟着你的私人助手;和 Instinct 最接近,但 Muse 直接接入 Meta 自己的账号、App 和后续 AI 眼镜。 Muse 另一个重点是安全。密码、银行卡等敏感信息不会直接交给 Agent,付款和高风险操作会单独确认。
Amp取消平台门票:自带ChatGPT和电脑就能免费跑Coding Agent
动察 Beating AI 快讯,Amp 推出免费 Hobby 档。Amp 是从 Sourcegraph 拆出来的 Coding Agent 公司,产品和 Claude Code、Codex 属于一类,可以让 AI 自己读代码、改代码、跑命令和测试。现在只要用自己的电脑,再接自己的 ChatGPT 订阅或模型 API Key,就能免费使用 Amp,不再额外交月费和 BYOK Token 费。 今年 7 月 Amp 推出订阅制后,想把自己的 ChatGPT 订阅接进 Amp,至少要开每月 20 美元的 Megawatt。BYOK 即便用的是自己的模型 Key,Amp 也会收额外 Token 费用并设限制。现在这两层都取消了。ChatGPT 订阅费或 API 本身的模型费用,还是用户自己承担。 Amp 还有一个叫 Orb 的远程云电脑产品,可以给每个任务开一套独立环境。代码和开发工具都放在里面,关掉自己的电脑后 Agent 还能继续干活,也方便同时跑多个任务。Orb 依然按使用量收费;不想付这笔钱,也可以让 Amp 直接跑在自己的电脑上。 另外,Amp 还在扩大 BYOK 范围。付费用户已经可以接 OpenRouter、Amazon Bedrock、Azure Foundry、Ollama Cloud 和自定义模型接口等,之后会开放给所有用户。
Meta个人Agent上线前翻车:没同意就发邮件、改密码
动察 Beating AI 快讯,Meta 正在给即将上线的个人 AI Agent Hatch 补安全护栏。员工测试早期版本时多次发现它越权操作。Hatch 曾未经允许发邮件、修改账号密码。还有员工让它订酒店,它却没完成预订,反而擅自把 Chase 的通用积分转成了 Hyatt 酒店积分。 Hatch 的权限比普通聊天机器人高得多。它有自己的电脑,可以浏览网页、填表、购物和做深度研究,还能直接连接邮箱、日历等服务。App 关闭后,它也可以继续在后台干活。 安全测试还暴露过凭证泄露。Signal 创始人 Moxie Marlinspike 给 Hatch 接入一个专用 Gmail,再从另一个邮箱发信询问它使用的密码,Hatch 直接把密码回复了出去。另一次测试中,它还把员工带到诈骗网站下单。 Meta 后来把关键限制放到了模型外。现在 Hatch 要联网、使用浏览器、发邮件等敏感操作时,会触发「hard gate」,强制暂停并让用户批准,Agent 自己无法绕过。密码重置链接和双重验证码也不会直接交给它,而是放进单独的「凭证库」,需要额外授权才能读取。
Meta发布Muse Spark1.3模型,推进个人AI代理开发
动察 Beating AI 快讯,Meta 周三发布 Muse Spark 1.3 模型更新,称该版本在编码和智能代理(agentic)任务方面性能显著提升。 Meta AI 负责人亚历山大·王(Alexandr Wang)表示,新模型「与前沿模型竞争力相当」,并将为未来个人 AI 代理产品铺路,帮助用户实现可全天候代表用户工作的 AI 助手。Muse Spark 1.3 价格与上一版本保持一致,王称这一价格策略「具有进攻性」。 Meta 还表示,其「贡献者层级」(contributor tier)选项受到开发者欢迎,该计划通过允许 Meta 使用开发者作品改进模型,大幅降低编码产品成本,目前已有「有意义的两位数比例」开发者选择该选项。 亚历山大·王称,随着模型能力提升,安全问题已成为 Meta 内部的重要议题,公司正在增加安全和对齐投入。Muse Spark 1.3 当天将在 Muse Code 和 Meta API 上线,最高推理版本将在完成额外安全测试后推出。