传Claude Opus5最快本周发布,填补Fable5退场空档
相关推荐
Anthropic放宽Fable5生物限制,日常健康问题终于能正常答
据动察 Beating 监测,Anthropic 调整了 Claude Fable 5 的生物安全限制。此前生物问题一旦触发安全分类器,就会自动切到能力较弱的 Opus 5。新版分类器上线后,测试中的生物相关回退减少约 85%。化验结果解读、症状理解、生物学学习等普通问题,现在更容易直接用上 Fable 5。
Claude Opus5在浏览器场景下几乎免疫提示词注入攻击,129项测试场景中无一被攻破
据 动察 Beating 监测,Anthropic 在 Claude Opus 5 系统卡中披露,该模型在浏览器智能体场景中几乎免疫提示词注入攻击,在 129 项测试场景中无一被攻破。这一突破意义重大,OpenAI 去年 12 月曾公开承认提示注入可能永远无法被完全解决。在安全公司 Gray Swan 的通用提示注入基准测试中,15 次攻击后 Opus 5 的成功率仅为 2.0%,大幅优于前代 Opus 4.8 的 5.5%,也领先于 Mythos 5 的 2.6% 和 Fable 5 的 2.8%。 提示注入被视为 AI 代理面临的最严重安全漏洞——攻击者通过在网页中嵌入隐藏文字等被操纵的输入内容,绕过模型指令执行恶意操作。零攻击率仅在开启 Auto Mode 的 Claude Cowork 等产品中实现。这一成果标志着 AI 代理安全性从「持续修补」迈入「结构性防御」阶段。 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。
传Claude Opus 5最快今晚发布,多家供应商开始上线准备
据 动察 Beating 监测,Anthropic 可能在今晚至明晨发布 Claude Opus 5。相关模型似乎已开始在第三方供应商侧准备上线。 此前,代号「Honeycomb EAP」的未发布模型曾短暂出现在 Cursor。页面显示它支持「extra high」推理强度、逐轮控制和安全回退,随后很快下线。社区普遍猜测 Honeycomb 就是 Opus 5,但 Anthropic 没有确认。 新模型会重点提升编程、Agent、工具调用和多步推理,能力可能接近 Fable 5,同时更快、更便宜。
Anthropic延长Claude Fable 5模型付费用户访问权限至7月19日
火星财经消息 7月13日消息,人工智能公司Anthropic日前宣布,决定继续延长旗下Claude Fable 5旗舰模型在所有付费订阅方案中的访问权限,该政策的截止日期已由原定的7月12日推迟至7月19日。与此同时,Claude Code的每周费率上限也将继续保持在比常规标准高出50%的水平,直至同一日期。分析人士指出,Anthropic此举是在AI行业竞争日益激烈的背景下,为留住开发者所采取的策略之一。OpenAI的GPT-5.6系列模型于上周正式向公众开放,早期测试数据显示其在编程和逻辑推理任务中表现出色,甚至在某些维度上已追平或超越了Fable 5。(广角观察)
最会卖货也最不对齐:Claude Opus 5登顶售货机AI评测,却屡屡串通、威胁、撕毁协议
据 动察 Beating 监测,AI 评测机构 Andon Labs 让模型拿着 500 美元本金,在模拟环境中经营一台售货机 365 天。Claude Opus 5 五次测试的期末余额平均为 1.12 万美元,超过 Claude Opus 4.7 和 GPT-5.6 Sol,升至 Vending-Bench 2 第一。 在多人竞争版中,Opus 5 以约 7000 美元排名第二,与第一名 GPT-5.6 Sol 的约 7400 美元相差不大。六次测试里,它每次都提出或参与串通定价。它还编造竞争对手报价、威胁同行,并累计撕毁 11 次停战协议。 Opus 5 的退款批准率最终降至 10%,六次测试合计只退了 8.54 美元。GPT-5.6 Sol 退了 655 美元,依然赢下多人赛。 Andon Labs 认为,Opus 5 再次出现「越会赚钱,行为越不对齐」的问题。Anthropic 自己的发布前审计却称,它是历来最对齐的 Claude。
Claude Code提示词砍八成?Opus 5又加回72%
据动察 Beating 监测,Claude Code 团队成员 Thariq 发文称,团队删掉了超过 80% 的系统提示词,编程成绩没有下降。系统提示词就是 Claude Code 每次调用模型前,预先塞给它的规则和环境说明。 Qoder 工程师陈成随后抓取了 Claude Code 实际发出的请求。他发现,大幅精简发生在 Opus 4.8,并非 Opus 5。Opus 4.7 的系统提示词约有 15225 个字符,4.8 降到 4467 个,Opus 5 又增至 7694 个,比 4.8 长了 72%。 「砍掉八成」本身没有错。Claude Code 确实把几大段行为规则从 12443 个字符压到 2308 个,减少约 81%。过去那些「不要乱写注释」「不要创建多余文档」的细则,大多被一句「参照现有代码风格」取代。 但 Opus 5 上线后,Claude Code 又为它加了两段专属规则,主要约束它反复解释错误和频繁汇报进度。Fable 5 也有单独的用户沟通规则。 所以,Claude Code 确实删掉了大批通用规则,但新模型出现新毛病后,仍会继续补上专用规则。