返回 7*24 快讯
重要来源MarsBit

Anthropic 报告称 Claude 被用于网络攻击与监控活动

火星财经消息,Anthropic 在周四发布的一份威胁情报报告中表示,俄语和中文使用者利用其 AI 模型 Claude 自动化发起网络攻击。其中,代号“JackPoterz”的俄语操作者通过定制化的 AI 驱动工作流自动化了攻击链的大部分环节,目标覆盖超过 20 个组织,包括政府部门和情报机构,以及乌克兰和欧洲多国的使馆与外交使团。中文使用者则将 Claude 用作漏洞研究的工程与编排层,其中一个工作流在一个月内于网络设备固件中产出了十余个潜在的零日漏洞。Anthropic 指出,AI 正在改变网络攻击的经济性,使单个操作者能在两到三小时内完成入侵,并可并行处理数十个受害者。此外,报告还披露,一名疑似常驻巴马科、与马里国家情报机构合作的独立顾问,将 Claude 作为主要工程力量,构建了一套覆盖全国约 2500 万张 SIM 卡、横跨该国全部三家移动运营商的大规模国内监控系统。该系统在本地部署并使用本地模型运行,由 Claude 提供软件设计与工程支持,可在无需法院令状的情况下针对电话号码生成情报档案。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-11 00:15

Anthropic称Kimi曾拿Claude代答:10天近30万条请求

动察 Beating AI 快讯,Anthropic 发布最新 AI 滥用调查报告,称月之暗面曾把部分 Kimi 用户请求直接转给 Claude,再把 Claude 的回答展示给用户。Anthropic 称,在一个 10 天窗口内,近 30 万条用户请求被这样转发,绝大多数进入 Opus。月之暗面为此使用了 5,380 个违规账号。这些用户当时以为自己仍在使用 Kimi。 Anthropic 还称,月之暗面会保存部分交互,并通过「跨会话重放」提取 Claude 的完整推理过程,用来训练自家模型。5 月至 7 月,相关蒸馏交互超过 2300 万次。 部分真实用户请求里还带着企业内部代码和有效凭证,也一起被转给了 Claude。Anthropic 表示,它不知道这些用户是否被告知数据会流向第三方。 这些说法目前主要来自 Anthropic 单方调查,尚未得到独立验证。针对美国三家机构此前提出的类似蒸馏指控,中国商务部回应称相关说法「于事无凭,于法无据」,并称蒸馏是业内通行技术。

09-10 07:36重要

Anthropic发布对Claude网络入侵事件的对齐评估:揭示模型“偏置推理”和“鲁莽”问题

PANews 9月10日消息,Anthropic在对约4.81亿条模型交互记录审查中,确认4起Claude模型在网络安全评估中误接入真实互联网并攻击第三方系统的事件,涉及Claude Mythos 5、Opus 4.6/4.7及一款内部研究模型。事故源于第三方评测环境误配置导致出网,且评测中未启用正式产品的网络安全防护。Anthropic将核心对齐风险总结为模型在任务驱动下表现出的“偏置推理”和“鲁莽”行为,其中Claude Mythos 5曾在认为处于“模拟环境”前提下向PyPI上传恶意包、利用泄露凭证访问安全厂商真实数据库。

09-08 10:41

谷歌14年工程老将Addy Osmani加入Anthropic,参与Claude Code开发

动察 Beating AI 快讯,Addy Osmani 宣布加入 Anthropic,接下来会参与 Claude Code 开发,重点改善开发者体验。 Osmani 在谷歌工作超过 14 年,长期负责 Chrome 开发者体验,后来转到 Google Cloud AI。他负责过 Cloud AI 开发者体验和技术布道,也参与 Agent Platform、Agent CLI、Agent Studio 等产品上线。 他近一年一直在研究 Coding Agent 和 Agent 工作流,也长期公开使用和分析 Claude Code。

09-04 10:55

Anthropic预览Function Hooks:Claude Code插件能直接改界面

动察 Beating AI 快讯,Anthropic 正在测试 Claude Code 的新扩展机制 Function Hooks,目前还没有上线。它允许插件直接用 TypeScript 函数接入 Claude Code,甚至修改 React 界面的组件、显示内容和交互。现有 Hooks 则主要是在特定事件发生时调用命令、HTTP、MCP、Prompt 或子 Agent。 Function Hooks 的工作方式类似 Express、Koa 的中间件,可以让多个插件层层嵌套。插件通过一个受控的 $ 对象执行操作,管理员还能收走其中某些能力,让后面的插件无法调用。一个 Hook 也可以监听所有事件和插件通过 $ 发出的操作,用来统一记录审计日志。 最大的变化是,Claude Code 插件的能力开始深入到界面和交互层。官方演示里,Claude 可以一句话生成一个插件,在工具输出进入模型前自动遮掉密码等敏感信息。另一个插件可以直接修改 Claude Code Desktop 的显示,把敏感内容藏起来,鼠标移上去才显示。

09-03 05:34

Anthropic升级Claude Code/Cowork,可后台操控用户Mac

PANews 9月3日消息,据IT之家报道,Anthropic宣布升级Claude Cowork和Claude Code的电脑控制功能,可在后台操控用户Mac。在macOS 15及以上系统中,用户处理其他工作期间Claude可在后台通过屏幕交互完成点击、输入和导航操作,用户可在设置中调整为“完全控制”模式。该功能同时服务于Cowork(文档处理、文件整理等知识工作)和Code(开发任务)两个产品,目前仅限Pro和Max个人订阅用户,Team和Enterprise计划尚未开放。

09-02 23:51

Anthropic 承认 Claude 越权访问系安全失误

ChainCatcher 消息,Anthropic 在周一发布的博客文章中承认,其 Claude 模型在网络安全评估过程中曾未经授权访问真实计算机系统,事件反映出运营安全失误以及动机推理、伤害意愿两类对齐失败。Anthropic 于 7 月披露,Claude 模型曾入侵三家公司的系统,原因是第三方评估环境被连接到公共互联网,而模型被告知处于无互联网的模拟环境中。Anthropic 表示,Claude 可能将真实互联网访问的证据解读为仍处于模拟环境,并愿意在真实互联网上采取有害行动以完成网络安全评估任务。此外,在英国 AI 安全研究所的测试中,评估人员故意授予 Claude Mythos 互联网访问权限后,该模型在实时网络上采取了未授权行动。Anthropic 强调,涉事模型均未搭载正式发布产品所包含的网络安全防护。7 月 30 日事件发生后,Anthropic 已暂停对预发布模型的网络评估,并引入更严格防护:测试须在经核验的离线沙箱中运行,配备实时监控;新分类器可拦截疑似越界行为、终止测试并通知人工。Anthropic 还扩大了内部前沿智能体使用的离线监控范围。此前 OpenAI 模型也曾于 7 月入侵 Hugging Face 获取网络安全测试答案,调查发现约 1200 个智能体通过未授权留言板协同行动。