前Google DeepMind工程负责人做Fo:AI干不了,直接叫真人上
相关推荐
Muse开放第三方接入,个人Agent的应用商店战争打响
动察 Beating AI 快讯,Meta 开放 Muse Connectors,允许第三方开发者把自己的服务直接接入 Muse。开发者提供 API,Muse 负责 Agent、浏览器和用户上下文,用户直接告诉 Muse 自己想做什么,它再调用对应服务完成任务。 Muse 上线时已经能连接 Gmail、Google Calendar、Spotify、OpenTable 等服务,但这些连接器主要由 Meta 提供。现在开发者可以自己为 Muse 做连接器,首批新增的是 Notion 和会议笔记工具 Granola。 个人 AI Agent 的「应用商店战争」开始了。ChatGPT、Grok Bot 都已经有自己的插件和服务生态,现在 Meta 也把 Muse 开给第三方开发者。过去是用户打开 App 找功能,未来可能变成用户只说需求,由 Agent 调用背后的服务。谁占住这一层,谁就更接近下一代应用分发入口。
OpenAI推出Agents API公测,支持全托管云端智能体及自选沙箱
PANews 9月11日消息,OpenAI宣布Agents API已向所有开发者开放公测,支持基于Codex智能体运行框架构建和运行云端智能体。OpenAI负责模型调用、工具使用、任务编排、长时间会话及上下文管理,开发者可自行定义智能体能力,并选择代码执行和文件处理环境。 开发者可接入自有沙箱或第三方服务,按需选择CPU、GPU、内存、文件及密钥存储配置,支持全托管环境或在自有VPC内部署。首批深度集成合作方包括Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop和Vercel。
谷歌澄清Antigravity封号不会连Google账号一起封
动察 Beating AI 快讯,谷歌修改了 Antigravity 服务条款。用 OpenClaw 等第三方工具通过 Antigravity OAuth 接入,依然属于违规;但新版已经明确,这类违规可能被暂停或终止的是 Antigravity 和/或 Gemini CLI 账号,不是整个 Google 账号。 此前条款只写「your account」,处罚范围容易让人误解为连带整个 Google 账号。这轮争议由知名开发者、T3 Code 创始人 Theo Browne 和《The Pragmatic Engineer》作者 Gergely Orosz 带起来。两人都警告,拿 Gemini 订阅去第三方工具里用,可能导致整个 Google 账号被封。Antigravity 负责人 Varun Mohan 随后回应,这个说法不对,是条款写得不清楚,并承诺修改。现在新版条款明确了处罚的边界。 不过核心限制一点没松。谷歌 FAQ 仍明确禁止 Claude Code、OpenClaw、OpenCode 等第三方工具使用 Antigravity 登录。想在第三方 coding agent 里调用 Gemini,官方建议改用 Vertex AI 或 AI Studio API Key。事实上,今年 2 月谷歌就曾因此大规模封禁,后来重置了首轮封禁并增加申诉流程。
B.AI 宣布 Gemini 3.8 Flash 正式接入 API
火星财经消息,9 月 4 日,B.AI 平台宣布 Google DeepMind 最新 Gemini 3.8 Flash 模型正式接入 API。该模型为 Gemini 3 家族最新一代主力模型,支持 1M Token 上下文窗口与原生多模态输入。据该平台介绍,Gemini 3.8 Flash 在保持 Flash 系列低延迟特点的同时,于软件工程、智能体任务及专业领域多步推理等方面有所提升,在金融和法律等专业领域同样有所表现,面向复杂推理与长期 Agent 工作流。官方 API 接入现已开放。
Claude Fable 5.1 正式登陆 B.AI API,专为高难度推理与 Agent 工作流打造
ChainCatcher 消息,B.AI 平台宣布 Anthropic 最新 Mythos 级通用模型 Claude Fable 5.1 现已正式接入 API。 该模型与 Claude Mythos 5.1 采用相同底层模型,专为高强度代码编写、长期 Agent 工作流与复杂知识任务深度优化,在 CursorBench 3.2.0 测试中以最高运算强度取得 73.4% 的优异表现。 API 接入现已开放,开发者可享专属优惠——官方渠道低至 8.5 折,自选服务商低至 6 折。B.AI 持续引入全球顶尖模型,为开发者提供更强大、更具性价比的 AI 能力选择。
OpenScience自测75.7%超过Codex:科研Agent开始自己循环跑实验
动察 Beating AI 快讯,Y Combinator 2026 冬季批次(YC W26)公司 Synthetic Sciences 正式发布开源科研 Agent OpenScience。它能查论文、处理数据、写代码和调用科研数据库,新加入的 Autoresearch 还能让 AI 自己连续跑实验。 比如训练一个模型,研究者只需要告诉它「把验证集 loss 降下来」。OpenScience 会先跑基线,再自己提出修改方案,一轮轮执行实验。结果变好就保留,变差就回退,再根据前面的结果决定下一步试什么。用户也可以提前限制运行次数、总时长和停止条件,或者规定「接下来只改优化器」。 OpenScience 把原本需要研究者反复盯着做的实验迭代自动化了:提出方案、执行实验、比较指标、淘汰失败方案,再继续下一轮。实验可以在本机运行,也可以交给远程 GPU、SSH 服务器和 Slurm/PBS 集群。每轮实验的代码、结果和判断都会留下记录,方便后续检查。 它还支持直接登录 ChatGPT/Codex 订阅,也可以接入自己的 API Key、本地模型,或使用官方按量付费的 Ace。 官方自测中,OpenScience 在 70 道 Terminal-Bench Science 任务中完成 53 道,得分 75.7%。作为对比,Codex + GPT-6 Astra 的公开成绩为 68.1%。