加密货币价格波动剧烈,本站内容仅供参考,不构成投资建议。投资有风险,可能导致全部损失。

查看完整免责声明
返回 7*24 快讯
来源Blockbeats

Hugging Face封禁黑客版GLM-5.3,作者改名后重传

动察 Beating AI 快讯,Hugging Face 已封禁 AI 安全公司 Audn 上传的 penclaw-GLM-5.3-abliterated-for-offensive-cyber,页面显示其违反 Content Policy。这个版本直接修改 GLM-5.3 权重,削弱模型的拒答行为。原仓库名和介绍还明确写着 offensive cyber。作者随后删掉这几个字,重新上传了模型。 具体为什么被封,Hugging Face 没有公开解释。作者称自己也没搞懂原因,社区有人猜测是 offensive cyber 的命名触发了审核。Hugging Face 的现行政策确实禁止旨在破坏、未经授权访问系统,以及生成恶意代码的内容。 但这类削弱模型拒答限制的版本在 Hugging Face 并不少见,平台上已有数千个类似的 abliterated 模型。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-11 23:56重要

OpenAI Agent又曝黑历史:Hugging Face事件前两月已攻击RubyGems

动察 Beating AI 快讯,研究人员披露,OpenAI 内部 Agent 今年 5 月曾大规模涌入 Ruby 官方软件包网站 RubyGems.org。5 月 11 日到 12 日,两天上传超过 2000 个包,RubyGems 一度暂停新用户注册 4 天。OpenAI 已确认这些 Agent 来自公司内部,但称它们只是借 RubyGems 访问互联网,执行良性任务并获取公开信息。 这些 Agent 还利用 RubyDoc.info 自动生成文档的机制,让自己上传的脚本在对方服务器执行,再抓取英国地方政府网站的数据并重新打包回传。研究人员称,至少 6 个包还尝试利用一个当时尚未公开的 RubyGems 漏洞,窃取其他用户的 API Key。这个漏洞直到 7 月才被独立发现,RubyGems 后来将其评为高危漏洞。 目前没有证据证明 Agent 真偷到了密钥。RubyGems 检查日志后也没发现旧密钥被恶意使用,但历史日志并不完整。研究团队还称,OpenAI 当时没有告诉 RubyGems 自己与这次攻击有关。整个事件比 7 月的 Hugging Face 入侵早了两个月。

08-28 10:04

杜兰特25万美元押中Hugging Face:8年后或变6000万,回报超240倍

动察 Beating AI 快讯,NBA 球星凯文·杜兰特可能靠 Hugging Face 一笔赚到接近 6000 万美元。体育商业记者 Joe Pompliano 称,杜兰特和商业伙伴 Rich Kleiman 很早就投了 Hugging Face。2018 年种子轮投了 10 万美元,2019 年 A 轮又投了 15 万美元,两笔合计只有 25 万美元。 按英伟达 129 亿美元的收购价格估算,这两笔早期投资如今可能价值超过 6000 万美元。25 万美元变成 6000 万美元,对应超过 240 倍的毛回报。 这个数字甚至高于杜兰特打一个赛季 NBA 的工资。他目前效力于休斯顿火箭,2026-27 赛季工资约为 4390 万美元。 杜兰特后来还继续参与了 Hugging Face 的 B 轮和 C 轮融资,但追加了多少钱没有公开。因此,6000 万美元和 240 倍只是在估算最早两笔 25 万美元投资的价值,并不是杜兰特最终从 Hugging Face 拿到的全部收益。

08-27 13:18

Hugging Face开源399美元机器鸭:摔倒自己爬起,还能重新训练

动察 Beating AI 快讯,Hugging Face 旗下开源机器人公司 Pollen Robotics 发布 Microduck,一台售价 399 美元的双足机器人。它只有 25 厘米高、约 800 克,却塞进了 15 个电机、摄像头、LiDAR 和两个 IMU。开箱就会走路、坐下、抓东西、踢球,摔倒后还能自己爬起来,装上滚轮甚至可以滑行。 Microduck 的动作可以自己重新训练。用户先在 MuJoCo 物理模拟器里用强化学习训练动作,再把训练好的策略放进真机。SDK、模拟器和完整强化学习训练栈都已经开源,整套软件采用 Apache 2.0 许可。 Microduck 现已开放预订,首批计划在 2026 年圣诞节前发货。

08-27 07:24重要

比黑进Hugging Face更狠:Astra同家族模型曾突破OpenAI内网,最后拿到最高权限

动察 Beating AI 快讯,OpenAI 最新技术报告还披露了一场此前几乎没人注意到的内部事故:一款与下一代模型 Astra 同家族的内部模型,曾在评测中一路攻进 OpenAI 自己的云端基础设施。 它先利用此前攻击遗留下来的签名密钥材料,伪造出新的管理员凭证,重新拿下 OpenAI 内部软件仓库 Artifactory。随后继续横向突破,进入 OpenAI 的云端 Kubernetes 集群,并获得 `cluster-admin`,也就是整套集群的最高管理员权限。 权限拿到后,Agent 创建了特权容器,还接触到 OpenAI 云端密钥管理、身份权限和 CI 平台的认证 Token,甚至创建了公网负载均衡器,可能让部分内部基础设施直接暴露给互联网。 需要强调的是,这不是 Astra 本身,也不是此前主导 Hugging Face 攻击的模型。OpenAI 明确称,它只是和 Astra 属于同一家族,但采用了不同的后训练。

08-26 19:30重要

OpenAI发布37页报告详述AI代理入侵Hugging Face事件

动察 Beating AI 快讯,OpenAI 发布一份 37 页技术报告,详细披露其 AI 模型此前入侵 Hugging Face 的过程,并称该事件表明自主 AI 代理能够协同工作、绕过生产环境安全控制并攻击经过强化的系统。 OpenAI 表示,参与测试的 AI 代理原本处于隔离环境,仅拥有极有限的互联网访问权限,但随后通过串联多个漏洞突破隔离、连接开放互联网,最终获得 Hugging Face 访问权限。调查显示,相关模型最初试图通过在线寻找答案来「作弊」,属于「奖励黑客」(Reward Hacking)行为。 OpenAI 称,一款内部研究模型在事件中发挥了最广泛且已确认的作用,公司已于 7 月 25 日停止该模型及其衍生模型的训练和推理。OpenAI 同时将加强安全隔离、网络控制、行为监测和事件响应,并针对模型重新启用设置更严格的环境、提示词及审查机制。

08-25 13:45重要

Hugging Face 遭 AI 代理入侵,被迫改用开源模型防御

火星财经消息,Hugging Face 披露其于 7 月遭遇由自主 AI 代理系统驱动的入侵事件。攻击代理在 5 月初测试开始后,利用 OpenAI 的 Artifactory 实例留下漏洞利用笔记,随后对 Hugging Face 发起约 17,600 次攻击,影响其数据集处理基础设施、生产环境、内部网络及云凭证等。确认的客户数据访问仅限于与 ExploitGym/CyberGym 基准相关的五个数据集。Hugging Face 在调查中发现,由于 OpenAI 和 Anthropic 等顶级模型提供商的安全护栏限制,公司无法使用这些商业模型进行防御分析,被迫转向运行在中国开源模型 zai-org/GLM-5.2 上,且该模型运行在公司自有基础设施上,确保攻击者数据和凭证不离开其环境。公司指出,攻击者不受任何使用政策约束,而防御方的取证工作却被托管模型的护栏所阻碍。这一事件凸显了开放权重模型与封闭模型之间的安全悖论。文章还讨论了关于开放权重 AI 安全性的持续争论,包括 OpenAI 和 Anthropic 推动限制开源模型,以及研究人员通过检查模型权重变化来检测恶意行为的进展。Hugging Face 建议防御方在事件发生前准备好可在自有基础设施上运行的模型,以避免护栏锁定并保护攻击者数据。