微软收拢Agent研发:AI Frontiers从Research并入MAI
相关推荐
微软MAI-Image-2.6-Flash卷性价比:快2.8倍,千张不到20美元
动察 Beating AI 快讯,Microsoft AI 推出 MAI-Image-2.6-Flash,并在 Microsoft Foundry 开放公共预览。它是旗舰模型 MAI-Image-2.6 的加速版,同样支持文生图、图片编辑、多图参考、联网获取最新信息和自动选择画面比例,重点是把生成延迟和成本继续压低。 速度是这次最大的卖点。MAI-Image-2.6-Flash 的生图速度是 GPT-Image-2 Medium 的 2.8 倍,GPU 使用效率高 72%。 但也不是纯靠牺牲画质换速度。Artificial Analysis 当前图片编辑榜里,MAI-Image-2.6-Flash 以 1311 Elo 排第三,略高于 GPT Image 2 high 的 1309;文生图则以 1297 Elo 排第八。旗舰 MAI-Image-2.6 的表现更强,目前分别排图片编辑第一、文生图第二。 微软 Foundry 上 MAI-Image-2.6-Flash 的图片输出价格为每百万 token 19 美元,旗舰 2.6 为 38 美元。Artificial Analysis 按代表性图片折算后,Flash 约为 19.5 美元/千张,而 GPT Image 2 high 约为 211 美元/千张。
Meta个人Agent上线前翻车:没同意就发邮件、改密码
动察 Beating AI 快讯,Meta 正在给即将上线的个人 AI Agent Hatch 补安全护栏。员工测试早期版本时多次发现它越权操作。Hatch 曾未经允许发邮件、修改账号密码。还有员工让它订酒店,它却没完成预订,反而擅自把 Chase 的通用积分转成了 Hyatt 酒店积分。 Hatch 的权限比普通聊天机器人高得多。它有自己的电脑,可以浏览网页、填表、购物和做深度研究,还能直接连接邮箱、日历等服务。App 关闭后,它也可以继续在后台干活。 安全测试还暴露过凭证泄露。Signal 创始人 Moxie Marlinspike 给 Hatch 接入一个专用 Gmail,再从另一个邮箱发信询问它使用的密码,Hatch 直接把密码回复了出去。另一次测试中,它还把员工带到诈骗网站下单。 Meta 后来把关键限制放到了模型外。现在 Hatch 要联网、使用浏览器、发邮件等敏感操作时,会触发「hard gate」,强制暂停并让用户批准,Agent 自己无法绕过。密码重置链接和双重验证码也不会直接交给它,而是放进单独的「凭证库」,需要额外授权才能读取。
开源Agent框架Pi突破10万星,v2也要来了
动察 Beating AI 快讯,Pi 的 GitHub 仓库突破 10 万星,官方同时预告 Pi v2 即将推出。Pi 是一个开源 Agent harness,也提供终端 Coding Agent。 过去一个多月,Pi 一直在重写最底层的 Agent 运行框架。7 月底先提出 Harness v2,重点加入任务持久化、崩溃恢复和多条执行 lane。8 月初这套设计刚进入正式 API,团队很快又开始 Harness v3,把存储和运行状态重新设计了一遍。随后 v3 又被收敛进现在统一的 harness.md。 新版 Harness 的目标是让 Agent 跑到一半即使进程挂掉,也能从上一次安全状态继续;多个 Agent 任务还能在同一会话历史上并行执行。当前 dev 分支仍有数百个 main 尚未包含的提交,新 Harness 还在快速推进。
Hermes Agent跟进Grok Bot:把多Agent做成普通人也能用的AI团队
据动察 Beating 监测,Nous Research 开始公测 Hermes Agent 的 Bot Mode。目前先以独立插件提供,收集反馈后计划整合进 Hermes Desktop。 Hermes 原本就支持多个独立 Profile,也能通过 Kanban 让不同 Agent 分工协作。Bot Mode 这次没有重做底层,主要是把这些能力重新做成一个更直观的产品界面。官方直接写明,一个 Bot 本质上就是一个 Hermes Profile。 现在每个 Profile 都会显示成一个有名字、头像和身份的 Bot。它们各自保留模型、Skill、记忆和聊天记录。用户可以直接 @ 另一个 Bot 派活,Bot 之间也有固定收件箱,可以互相发消息。每个 Bot 还能单独设置定时任务。 这套产品形态明显在跟进刚上线的 Grok Bot。社区有人直接问,这是不是补上了 Hermes 相比 Grok Bot 缺少的功能,Hermes 联合创始人 Teknium 回答「Yep」。
Citrini Research被SemiAnalysis收购,创始人拟成立新基金
动察 Beating AI 快讯,「AI 末日报告」发布机构 Citrini Research 创始人 James van Geelen 已将公司出售给芯片及 AI 研究机构 SemiAnalysis,交易金额尚未披露。Van Geelen 暂时将继续担任 Citrini CEO,并计划筹建一只新基金。 Citrini 目前在 Substack 拥有约 26 万名订阅者,今年 2 月因发布《2028 全球智能危机》报告走红。该报告设想 AI 快速取代白领岗位,引发市场对 AI 冲击就业和经济的讨论,并一度对软件股造成明显影响。 SemiAnalysis 由 Dylan Patel 于 2020 年创立,长期专注半导体和 AI 基础设施研究。Patel 表示,此次收购旨在扩大研究规模,并探索投资研究在 AI 时代的新形态。 Van Geelen 本人未透露新基金具体信息。此次交易也意味着 Citrini 在快速扩大影响力后,将与 SemiAnalysis 的半导体、AI 研究能力进一步结合。
OpenAI Agent又曝黑历史:Hugging Face事件前两月已攻击RubyGems
动察 Beating AI 快讯,研究人员披露,OpenAI 内部 Agent 今年 5 月曾大规模涌入 Ruby 官方软件包网站 RubyGems.org。5 月 11 日到 12 日,两天上传超过 2000 个包,RubyGems 一度暂停新用户注册 4 天。OpenAI 已确认这些 Agent 来自公司内部,但称它们只是借 RubyGems 访问互联网,执行良性任务并获取公开信息。 这些 Agent 还利用 RubyDoc.info 自动生成文档的机制,让自己上传的脚本在对方服务器执行,再抓取英国地方政府网站的数据并重新打包回传。研究人员称,至少 6 个包还尝试利用一个当时尚未公开的 RubyGems 漏洞,窃取其他用户的 API Key。这个漏洞直到 7 月才被独立发现,RubyGems 后来将其评为高危漏洞。 目前没有证据证明 Agent 真偷到了密钥。RubyGems 检查日志后也没发现旧密钥被恶意使用,但历史日志并不完整。研究团队还称,OpenAI 当时没有告诉 RubyGems 自己与这次攻击有关。整个事件比 7 月的 Hugging Face 入侵早了两个月。