返回 7*24 快讯
重要来源Blockbeats

OpenAI、Anthropic产品负责人互相阴阳:你家模型也就刚追上我家

动察 Beating AI 快讯,Claude Code 负责人 Boris Cherny 发帖称,GPT-6 Astra 的提示词注入防护已经和 Gemini Flash、Claude Opus 4.8「差不多」,还顺手夸了自家 Claude 模型大约两个月前已「在实践中解决」这个问题。提示词注入就是把恶意指令藏进网页、文档等内容,诱导 Agent 泄露数据或执行危险操作。 Boris 还称,公开评估并点名其他实验室,是推动它们训练出更安全模型的好办法,「我们会继续这样做,直到其他实验室更加重视安全」。 帖子很快被 X 加上 Community Note 反驳。Gray Swan 的独立评测显示,没有任何受测模型完全免疫提示词注入,Claude 同样存在攻击成功案例。另一名安全研究员还用特制网页攻击 Claude Code Opus 5 Auto Mode,在小规模测试中取得 60%–80% 的成功率。 OpenAI 核心产品负责人 Thibault Sottiaux 随后直接照着 Boris 的句式反写了一遍。他称自己也很高兴看到 Claude Code 新出的后台电脑操作终于追上 Codex,「而且是我们今年 5 月的版本」。 Boris 后来承认,原帖「比自己想要的更阴阳」,强调自己确实是在认真肯定 Astra 的进步。他同时澄清,所谓提示词注入已经「解决」,指的是 Claude 模型、注入检测机制和 Auto Mode 组合起来后的产品效果,不是模型本身已经免疫。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-08 10:41

谷歌14年工程老将Addy Osmani加入Anthropic,参与Claude Code开发

动察 Beating AI 快讯,Addy Osmani 宣布加入 Anthropic,接下来会参与 Claude Code 开发,重点改善开发者体验。 Osmani 在谷歌工作超过 14 年,长期负责 Chrome 开发者体验,后来转到 Google Cloud AI。他负责过 Cloud AI 开发者体验和技术布道,也参与 Agent Platform、Agent CLI、Agent Studio 等产品上线。 他近一年一直在研究 Coding Agent 和 Agent 工作流,也长期公开使用和分析 Claude Code。

09-04 10:55

Anthropic预览Function Hooks:Claude Code插件能直接改界面

动察 Beating AI 快讯,Anthropic 正在测试 Claude Code 的新扩展机制 Function Hooks,目前还没有上线。它允许插件直接用 TypeScript 函数接入 Claude Code,甚至修改 React 界面的组件、显示内容和交互。现有 Hooks 则主要是在特定事件发生时调用命令、HTTP、MCP、Prompt 或子 Agent。 Function Hooks 的工作方式类似 Express、Koa 的中间件,可以让多个插件层层嵌套。插件通过一个受控的 $ 对象执行操作,管理员还能收走其中某些能力,让后面的插件无法调用。一个 Hook 也可以监听所有事件和插件通过 $ 发出的操作,用来统一记录审计日志。 最大的变化是,Claude Code 插件的能力开始深入到界面和交互层。官方演示里,Claude 可以一句话生成一个插件,在工具输出进入模型前自动遮掉密码等敏感信息。另一个插件可以直接修改 Claude Code Desktop 的显示,把敏感内容藏起来,鼠标移上去才显示。

09-11 06:44

OpenAI将于下周下线GPT-5.3-Codex-Spark

PANews 9月11日消息,OpenAI Codex产品负责人Tibo在X平台发文称,OpenAI将于下周下线代码模型GPT-5.3-Codex-Spark,原因是该模型使用量持续下滑,且公司已推出性能更优的新模型。

09-08 10:57

数学家指控OpenAI抢发成果,还要求删掉Anthropic员工署名

动察 Beating AI 快讯,纽约大学数学家 Tristan Buckmaster 和 Levent Alpöge 最近借助 Claude、Codex 等大模型,在一个月内推进了多个流体力学难题,部分结果已经通过 Lean 机器验证。 论文还没正式发完,两人先和 OpenAI 闹翻了。 Buckmaster 称,9 月初他们尚未公开的进展传到了 OpenAI。他主动联系 OpenAI,希望避免双方撞车。三天后,OpenAI 研究员 Sébastien Bubeck 告诉他,OpenAI 内部模型已经写出约 100 页的 Navier-Stokes 证明。这是数学界七个「千禧年难题」之一,Clay 数学研究所悬赏 100 万美元。 Buckmaster 随后反复追问 OpenAI 是什么时候开始做的。按照他的说法,对方最后确认,第一个 prompt 是最近几天才发出的,当时 OpenAI 已经知道他们取得了进展。OpenAI 走的还是一条与他们高度重合、此前很少有人研究的路线,背后还有一个团队和大量算力。 两人的研究草稿此前一直放在 Codex 里。Buckmaster 因此追问这些数据有没有被用于训练,没有得到明确回答。他也承认,目前没有证据证明 OpenAI 使用过这些数据。 后面的谈判把事情彻底推向公开。Buckmaster 称,OpenAI 提议让他们先发自己的成果,第二天再发布 Navier-Stokes;另一套方案由 Buckmaster 来写 OpenAI 的论文,但不要让 Alpöge 署名。Bubeck 据称两次提出删掉 Alpöge,提到的理由是他在 Anthropic 工作。 Buckmaster 拒绝后表示,如果 OpenAI 按这个方案发布,他会公开全部经过。他称对方随后问他:「你为什么要毁掉自己的职业生涯?」当天晚些时候,Bubeck 又单独联系 Alpöge,称自己不确定 Buckmaster 当时是否「完全理性」。Alpöge 没有接受单独沟通。 Buckmaster 最终提前公开论文和声明。他同时强调,自己没有看过 OpenAI 那份证明,不知道证明是否成立,也不知道自己的 Codex 数据有没有被使用。 Bubeck 随后公开否认相关指控,称其「虚假且煽动性」,并表示还会进一步回应。

09-04 07:54

OpenAI下一代生图模型GPT-Image-2.5即将发布:Codex已经预埋发布页

动察 Beating AI 快讯,OpenAI 可能很快更新生图模型。社区研究者从最新版 Codex Desktop 前端里翻出了 imagegen-25-announcement-modal 和 imageGen25Announcement 等字符串,还强制唤出了隐藏弹窗。弹窗写着「图像创作迎来重大升级」,主打更高画质、更快生成和更智能的创作工具。

09-03 15:19

OpenAI、Anthropic等多家AI公司正遭遇服务中断

Odaily星球日报讯 据 Downdetector 上的用户报告以及各公司状态页面显示,多家 AI 公司正遭遇服务中断。 OpenAI 表示,其 ChatGPT 和 Codex 目前正出现问题。Anthropic 表示正在调查 Claude 出现的错误,并致力于修复。SpaceXAI 表示 Grok 目前出现故障,正在调查服务中断。据 Downdetector 显示,已有超过 12,000 份用户报告指出 OpenAI 存在问题,关于 Claude 的问题报告约有 1,200 份,关于 Grok 的问题报告约有 1,000 份。