返回 7*24 快讯
来源Blockbeats

OpenAI测试Codex持续运行模式:任务做完还能继续跟进

动察 Beating AI 快讯,OpenAI 正在测试 Codex 的 Persistent mode,也就是持续运行模式。普通 Agent 完成一次任务后通常就会停止,而这个模式可以让 Codex 完成当前任务后,继续检查和处理后续事项。相关代码已经出现在 Codex 的公开仓库中,但 OpenAI 表示近期没有上线计划。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-01 10:45

OpenAI给Codex连挖3人:Linear产品负责人+Kairos两位创始人加盟

动察 Beating AI 快讯,OpenAI 一天内给 Codex 和 ChatGPT 连挖 3 人。Linear 产品负责人 Nan Yu 宣布加入 OpenAI,结束在 Linear 4 年的工作。随后,Kairos Computer 两位联合创始人 Manas Bam 和 Samarth Patel 也宣布加入,三人去向都是 Codex 和 ChatGPT。 Kairos 做的是能直接操作电脑的个人 Agent。它给 Agent 一台云端电脑,让它自己登录网站、操作浏览器和软件,跨应用完成任务。两位创始人说,他们创办 Kairos 时想做「每个人的个人 AGI」,现在准备去 OpenAI 继续做这件事。

09-11 23:56重要

OpenAI Agent又曝黑历史:Hugging Face事件前两月已攻击RubyGems

动察 Beating AI 快讯,研究人员披露,OpenAI 内部 Agent 今年 5 月曾大规模涌入 Ruby 官方软件包网站 RubyGems.org。5 月 11 日到 12 日,两天上传超过 2000 个包,RubyGems 一度暂停新用户注册 4 天。OpenAI 已确认这些 Agent 来自公司内部,但称它们只是借 RubyGems 访问互联网,执行良性任务并获取公开信息。 这些 Agent 还利用 RubyDoc.info 自动生成文档的机制,让自己上传的脚本在对方服务器执行,再抓取英国地方政府网站的数据并重新打包回传。研究人员称,至少 6 个包还尝试利用一个当时尚未公开的 RubyGems 漏洞,窃取其他用户的 API Key。这个漏洞直到 7 月才被独立发现,RubyGems 后来将其评为高危漏洞。 目前没有证据证明 Agent 真偷到了密钥。RubyGems 检查日志后也没发现旧密钥被恶意使用,但历史日志并不完整。研究团队还称,OpenAI 当时没有告诉 RubyGems 自己与这次攻击有关。整个事件比 7 月的 Hugging Face 入侵早了两个月。

09-11 08:50重要

OpenAI否认偷用数学家未公开研究:Codex草稿没影响Navier-Stokes证明

动察 Beating AI 快讯,OpenAI 最新回应了 Navier-Stokes 抢功争议,明确否认偷用了纽约大学数学家 Tristan Buckmaster 的未公开研究。公司调查后称,Buckmaster 过去两个月提交给 Codex 的 prompt,不可能以任何方式影响这套内部模型,包括通过训练。 Buckmaster 此前和 Levent Alpöge 一直在研究同一方向,大量草稿都放进了 Codex。两人的进展传到 OpenAI 后,OpenAI 几天内集中算力拿出了 Navier-Stokes 证明。Buckmaster 因此怀疑,自己的未公开研究是不是已经被模型学了进去。OpenAI 现在把这一点明确否认了。 OpenAI 还把时间边界划到了 7 月 3 日,此后的任何用户输入,都不可能影响这套系统。社区有人猜测,这一天可能对应某个训练数据截点或模型 checkpoint,但 OpenAI 没有解释。 Buckmaster 和 Alpöge 的关键突破发生在 8 月中旬,远远晚于 OpenAI 划出的 7 月 3 日边界。

09-11 07:44

OpenAI上线Data Agent:不会SQL也能查公司数据库、做数据看板

动察 Beating AI 快讯,OpenAI 在 ChatGPT Work 上线 Data Agent。员工直接问「为什么销量掉了」「哪批客户最可能流失」,它就能自己调取公司数据、分析原因,还能生成会跟着数据更新的数据看板。 它可以连接 Snowflake、BigQuery、Databricks、Redshift、MongoDB 等数据库,也能读取 Google Drive 和 SharePoint。公司原本怎么定义「活跃用户」「收入」等指标,它也会沿用这些口径和现有权限,避免同一个指标被不同人算出不同结果。 分析完后,它还能把结果发到 Slack 或邮件,并在用户批准后继续执行后续操作。OpenAI 称,公司几乎所有产品团队,以及超过三分之二的销售、市场等团队,都已经在使用这类数据 Agent。

09-11 03:14

OpenAI推出Agents API公测,支持全托管云端智能体及自选沙箱

PANews 9月11日消息,OpenAI宣布Agents API已向所有开发者开放公测,支持基于Codex智能体运行框架构建和运行云端智能体。OpenAI负责模型调用、工具使用、任务编排、长时间会话及上下文管理,开发者可自行定义智能体能力,并选择代码执行和文件处理环境。 开发者可接入自有沙箱或第三方服务,按需选择CPU、GPU、内存、文件及密钥存储配置,支持全托管环境或在自有VPC内部署。首批深度集成合作方包括Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop和Vercel。

09-09 06:59重要

OpenAI、Anthropic产品负责人互相阴阳:你家模型也就刚追上我家

动察 Beating AI 快讯,Claude Code 负责人 Boris Cherny 发帖称,GPT-6 Astra 的提示词注入防护已经和 Gemini Flash、Claude Opus 4.8「差不多」,还顺手夸了自家 Claude 模型大约两个月前已「在实践中解决」这个问题。提示词注入就是把恶意指令藏进网页、文档等内容,诱导 Agent 泄露数据或执行危险操作。 Boris 还称,公开评估并点名其他实验室,是推动它们训练出更安全模型的好办法,「我们会继续这样做,直到其他实验室更加重视安全」。 帖子很快被 X 加上 Community Note 反驳。Gray Swan 的独立评测显示,没有任何受测模型完全免疫提示词注入,Claude 同样存在攻击成功案例。另一名安全研究员还用特制网页攻击 Claude Code Opus 5 Auto Mode,在小规模测试中取得 60%–80% 的成功率。 OpenAI 核心产品负责人 Thibault Sottiaux 随后直接照着 Boris 的句式反写了一遍。他称自己也很高兴看到 Claude Code 新出的后台电脑操作终于追上 Codex,「而且是我们今年 5 月的版本」。 Boris 后来承认,原帖「比自己想要的更阴阳」,强调自己确实是在认真肯定 Astra 的进步。他同时澄清,所谓提示词注入已经「解决」,指的是 Claude 模型、注入检测机制和 Auto Mode 组合起来后的产品效果,不是模型本身已经免疫。