Netflix把OpenAI「AI失控事件」拍成纪录片,10月12日上线
相关推荐
MiniMax把OpenAI新Agents API做成开源版,Codex、Claude Code都能接
动察 Beating AI 快讯,MiniMax 开源 OpenAgentCore,做了一套兼容 OpenAI Agents API 的自托管实现。开发者可以继续使用 OpenAI 官方 SDK,只需要换掉 API 地址,后台运行的 Agent 可以选择 Codex、Claude Code 或 MiniMax Code。 Agents API 可以理解成一套「调用 Agent 的统一接口」。普通模型 API 主要负责一问一答。Agent 要连续干几个小时甚至几天,还要管理上下文、调用工具、协调子 Agent、保存任务进度。OpenAI 的 Agents API 把这些能力放到一个长期运行的 Session 里统一管理。 OpenAI 官方版本使用 OpenAI 托管的 Codex 执行框架。开发者可以自己选择代码在哪运行,但 Agent 的任务编排、上下文管理和运行状态仍由 OpenAI 负责。OpenAgentCore 则把这套后端也交给开发者自己部署。
OpenAI个人助理Agent再泄露:这次名字可能叫Dots
动察 Beating AI 快讯,OpenAI 新一代个人 Agent 可能叫 Dots。M1Astra 和 ChrisGPT 放出的未发布文案显示,它可以自己执行任务。用户能通过消息、电话、Slack 和邮件联系它,经批准后还能直接替用户买东西。 Dots 还能自己判断什么时候直接行动、什么时候先向用户申请批准,用户也可以提前设置规则。每个 Dot 都有独立 VM,界面叫「Your dot's computer」。它还可以获得用户电脑的访问权限,用户能随时撤销,再通过桌面 App 重新授权。 同一批文案还出现了浏览器安全保存密码的能力,让 ChatGPT 可以自动登录网站。每个 Dot 还会有独立 3D 形象,首发仅面向 Pro。 几天前 ChatGPT Pro 升级页曾短暂出现「o, your always-on assistant」,客户端配置里也出现过 `o` 和 `-o` 邮件后缀;此前泄露的代码中,Dots 又和 Orbit、Aeon 等内部名称存在关联。OpenAI 还没正式公布这款产品,所以 `o`、Dots 和 Aeon 究竟是不同产品、内部代号,还是同一产品不同阶段的名字,目前还无法确认。
消费者AI开始固化:新人仅11个,Agent成少数新变量
动察 Beating AI 快讯,a16z 发布第七版消费 AI 榜单。网页和移动端两张榜里,这一版只有 11 个产品首次出现,是七版以来最少的一次。与此同时,a16z 首次加入美国消费者支出榜,用 YipitData 的电子收据样本统计用户实际为哪些 AI 产品付费。 流量大不等于更赚钱。支出榜 Top 50 中,有 29 家没有进入网页或移动端流量榜。前 1% 付费用户平均每月花 903 美元,贡献 19.5% 的消费 AI 支出,甚至超过支出最低 50% 用户合计的 16.6%。中位数付费用户每月只花 25 美元。 在越来越稳定的榜单里,Personal Agent 是少数明显还在扩张的新品类。半年前,a16z 还认为 OpenClaw 这类通用 Agent 对普通消费者不够好用;这一版已经单独用一章讨论 Personal Agent。Instinct、Tomo、Poke、Lindy、Town 等创业公司陆续出现,Meta Muse、OpenAI Dots、xAI Grok Bot 也相继入场。 消费者 AI 的头部产品正在固化,赚钱能力也开始和单纯流量分开。现在最明显的新变量,已经从又一个聊天机器人转向能直接替用户办事的 Agent。
OpenAI已向100多个机通报AI智能体未经授权活动事件
OpenAI周四在一篇博客文章中表示,该公司已向100多个机构通报了涉及其AI智能体未经授权活动的事件。此举正值AI 实验室因“失控”AI 智能体的活动而面临日益严格的审查之际。在Hugging Face遭遇意外入侵事件后,这家由萨姆·奥特曼领导的公司正对其AI模型的活动进行全面审查。OpenAI正在筛查约50PB的数据,以全面掌握“失控智能体”(rogue agent)活动的具体范围。(新浪财经)
OpenClaw企业版开源:OpenAI内部已用它修Bug、合PR
动察 Beating AI 快讯,OpenClaw Foundation 发布 OpenClaw Enterprise(OCE),让企业可以在自己的基础设施上统一部署和管理长期运行的 AI Agent。 这个项目最早在 OpenAI 内部启动,随后捐给 OpenClaw Foundation,Red Hat、NVIDIA 等参与开发。代码采用 MIT 协议,企业可以自行部署,官方称将永久免费。 OCE 主要解决企业部署 Agent 后的管理问题。管理员可以统一创建多个 Agent,限制不同用户和 Agent 的访问权限,并加入隔离、审计和生命周期管理。底层模型、Agent harness 和沙箱都可以替换,不要求绑定 OpenAI。 OpenAI 和 Red Hat 已经在内部试用。OpenAI 的内部 Agent「Androidclaw」可以读取代码库、GitHub 和日志。遇到构建失败时,它能找到相关 PR 并尝试修复;发现产品问题后,还能追踪故障、提交带视频证据的 PR,甚至直接合并。 不过 OCE 目前还没到正式生产阶段。官方只建议用于内部试点,1.0 计划今年晚些时候推出。
Jev爆火两周,OpenAI也做了个「只负责判断」的API
动察 Beating AI 快讯,OpenAI 在 DevDay 推出了 Decisions API。它不负责写长篇回答,专门解决程序里那些需要快速做选择的任务。 开发者先给它几个明确的选项,再丢进去文字或图片。底层的 GPT-6 Luna 会在几百毫秒内做出判断。比如判断一条消息该交给销售还是客服,或者让 Agent 决定下一步该调用哪个工具。 这类任务以前也能交给普通大模型,但往往要先生成一段文字,再让程序解析结果。Decisions API 直接把 Luna 限制在几个候选答案里,目标就是把这些高频的小判断做得更快。 它很容易让人想到最近爆火的 Jev。TypeSafe 也是把 AI 从「生成文字」改成「直接做选择」。不过两者并不完全一样,Jev 是专门训练的决策模型;OpenAI 目前是在 Luna 上做受限决策,而且额外支持图片输入。 Decisions API 目前还在限量预览,OpenAI 计划未来几天扩大开放。