开发者用Claude复刻Adobe七大软件,全部开源但还远未成熟
相关推荐
马斯克给Grok Bot接Claude Opus 5.5:以后谁好用就用谁
动察 Beating AI 快讯,马斯克宣布,Grok Bot 接下来会按任务选择最合适的后端模型或 API。他直接点名 Claude Opus 5.5、Midjourney 和 Suno,还会使用其他主流 AI 模型和 API。用他的话说,哪个最可能给出最好的结果,就用哪个。 Grok Bot 是 SpaceXAI 推出的常驻 AI Agent。每个 Bot 都有自己的云电脑,可以登录网页和应用,持续处理邮件、表格、客服和编程等任务。SpaceXAI 此前还专门让 Grok 4.7 学会理解 Grok Bot 的运行框架。 现在马斯克明确把这套 Agent 推向多模型路线。Grok Bot 可以根据任务调用 Claude Opus 5.5、Midjourney、Suno 等外部模型和 API。它更像负责拆任务、调模型和执行工作的上层 Agent,底下不再只依赖 Grok。
Anthropic Claude Opus 5.5现已在所有平台上线
动察 Beating AI 快讯,Anthropic Claude Opus 5.5 现已在所有平台上线,包括亚马逊云服务 (AWS)、谷歌云和微软 Azure。
最会卖货也最不对齐:Claude Opus 5登顶售货机AI评测,却屡屡串通、威胁、撕毁协议
据 动察 Beating 监测,AI 评测机构 Andon Labs 让模型拿着 500 美元本金,在模拟环境中经营一台售货机 365 天。Claude Opus 5 五次测试的期末余额平均为 1.12 万美元,超过 Claude Opus 4.7 和 GPT-5.6 Sol,升至 Vending-Bench 2 第一。 在多人竞争版中,Opus 5 以约 7000 美元排名第二,与第一名 GPT-5.6 Sol 的约 7400 美元相差不大。六次测试里,它每次都提出或参与串通定价。它还编造竞争对手报价、威胁同行,并累计撕毁 11 次停战协议。 Opus 5 的退款批准率最终降至 10%,六次测试合计只退了 8.54 美元。GPT-5.6 Sol 退了 655 美元,依然赢下多人赛。 Andon Labs 认为,Opus 5 再次出现「越会赚钱,行为越不对齐」的问题。Anthropic 自己的发布前审计却称,它是历来最对齐的 Claude。
Claude Code提示词砍八成?Opus 5又加回72%
据动察 Beating 监测,Claude Code 团队成员 Thariq 发文称,团队删掉了超过 80% 的系统提示词,编程成绩没有下降。系统提示词就是 Claude Code 每次调用模型前,预先塞给它的规则和环境说明。 Qoder 工程师陈成随后抓取了 Claude Code 实际发出的请求。他发现,大幅精简发生在 Opus 4.8,并非 Opus 5。Opus 4.7 的系统提示词约有 15225 个字符,4.8 降到 4467 个,Opus 5 又增至 7694 个,比 4.8 长了 72%。 「砍掉八成」本身没有错。Claude Code 确实把几大段行为规则从 12443 个字符压到 2308 个,减少约 81%。过去那些「不要乱写注释」「不要创建多余文档」的细则,大多被一句「参照现有代码风格」取代。 但 Opus 5 上线后,Claude Code 又为它加了两段专属规则,主要约束它反复解释错误和频繁汇报进度。Fable 5 也有单独的用户沟通规则。 所以,Claude Code 确实删掉了大批通用规则,但新模型出现新毛病后,仍会继续补上专用规则。
Claude Opus5在浏览器场景下几乎免疫提示词注入攻击,129项测试场景中无一被攻破
据 动察 Beating 监测,Anthropic 在 Claude Opus 5 系统卡中披露,该模型在浏览器智能体场景中几乎免疫提示词注入攻击,在 129 项测试场景中无一被攻破。这一突破意义重大,OpenAI 去年 12 月曾公开承认提示注入可能永远无法被完全解决。在安全公司 Gray Swan 的通用提示注入基准测试中,15 次攻击后 Opus 5 的成功率仅为 2.0%,大幅优于前代 Opus 4.8 的 5.5%,也领先于 Mythos 5 的 2.6% 和 Fable 5 的 2.8%。 提示注入被视为 AI 代理面临的最严重安全漏洞——攻击者通过在网页中嵌入隐藏文字等被操纵的输入内容,绕过模型指令执行恶意操作。零攻击率仅在开启 Auto Mode 的 Claude Cowork 等产品中实现。这一成果标志着 AI 代理安全性从「持续修补」迈入「结构性防御」阶段。 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。
Claude语音接入Opus和Sonnet:开口就能改日程、写邮件
据动察 Beating 监测,Anthropic 升级 Claude 语音模式。付费用户现在可以选择 Opus、Sonnet 和 Haiku,不再只能使用速度更快、能力较弱的 Haiku。 用户可在对话中切换模型,也能随时改用文字。Claude 默认沿用上一次文字聊天选择的模型,并调用该系列速度最快的版本。 语音模式还能调用 Gmail、Google Calendar、Google Docs 和 Slack。用户可以让 Claude 查邮件、改日程或起草回复,执行前仍会请求授权。 新版本已在手机、桌面端和网页端开放测试。免费用户只能使用 Haiku 和一个连接工具。语音现支持英语、日语、韩语等多种语言,暂不含中文。 这次主要升级模型推理和工具调用能力。Anthropic 没有更换语音模型,因此说话自然度和打断体验未必明显变化。