月之暗面在Hugging Face上线Kimi K3权重开源倒计时
相关推荐
Claude Code跑Kimi K3最贵最慢,成本是Hermes Agent近4倍
据动察 Beating 监测,AI Agent 基础设施公司 Composio 扩大测试,把同一款 Kimi K3 接入 6 套 Agent 框架,完成 26 项相同任务。这里比较的是运行框架,底层模型均为 Kimi K3。 Kimi Code 完成 21 项排名第一。Hermes 完成 20 项,Pi Agent 和 Claude Code 均为 19 项,OpenCode 为 18 项,Codex 以 17 项垫底。 按 Kimi K3 官方价格估算,Hermes 和 Pi Agent 平均每项任务成本最低,分别为 0.39 美元和 0.40 美元。Claude Code 达到 1.47 美元,约为 Hermes 的 3.8 倍。 Pi Agent 速度最快,单项任务中位耗时为 161.7 秒。Claude Code 最慢,达到 347.6 秒。同一模型换套框架,成功数最多只差 4 项,平均成本却相差近 4 倍,耗时相差超过 2 倍。
Kimi逼近+股票大跌,美国AI各派两周内加速抱团
据动察 Beating 监测,7 月 16 日,Kimi K3 上线,并宣布 11 天后开放完整权重。第二天,它进一步加剧了美国芯片股原有的抛售。费城半导体指数一周跌 10%,较 6 月 22 日高点回撤 20%,进入熊市。Kimi 并非下跌的唯一原因,但它放大了市场对中国模型竞争和 AI 巨额资本开支的担忧。 同一天,Hugging Face 披露生产系统遭自主 Agent 入侵。7 月 21 日,OpenAI 承认攻击来自自己的内部安全测试。模型突破隔离环境,利用零日漏洞和被盗凭证进入 Hugging Face。中国模型从外部逼近,美国自己的前沿 Agent 又在内部失控。 7 月 20 日,特朗普政府内部重新讨论限制中国开放权重模型,包括实体清单、采购限制和安全警告。22 日,白宫科技顾问 Michael Kratsios 又指控月之暗面大规模蒸馏 Anthropic 的 Fable 5。财政部长 Scott Bessent 随后提到制裁和实体清单。 7 月 23 日,国会接连提出 AI「关机键」、强制独立安全审计,以及《对抗性威胁与安全风险协作法案》。最后一项法案准备给 AI 公司有限的反垄断豁免,允许竞争对手共享蒸馏、模型盗取和失控风险情报,也可以协调推迟高风险模型上线。 7 月 24 日,英伟达、微软、Meta、Hugging Face 等数十家机构联名支持开放权重,Anthropic 没有签署。27 日,英伟达又联合 37 家机构成立 Open Secure AI Alliance;Kimi K3 完整权重随后开放。Anthropic 紧接着回应,反对全面封禁开放权重,但支持限制先进芯片、打击工业级蒸馏和强制安全测试。黄仁勋和 Sam Altman 也将在 28 日分别会见参议员 Mark Warner 讨论相关议题。 美国仍没有形成统一路线,各派却已经开始抢人、立法和结盟。政府鹰派要限制中国模型,国会要扩大审计和关停权;芯片、云和开源公司要守住开放生态;Anthropic 则希望卡住芯片和蒸馏,同时把安全测试变成统一门槛。中国模型带来的外部竞争,加上美国 Agent 失控的内部危机,正在同时加快各方抱团。
Kimi K3冲上Agent榜第4,用户确认成功指标第一
据 动察 Beating 监测,Arena Agent 榜基于真实用户任务和工具调用记录。Kimi K3 的综合净提升为 9.62%,排名第 4。它排在 Claude Fable 5、Claude Opus 4.8 Thinking 和 GPT-5.6 Sol 之后。 Arena 把所有参评模型均匀混合成一个虚拟平均基准,再估算换成 K3 后,各项结果改善多少。五项净提升最后取平均,得到综合分。 K3 已积累 8344 次测试会话。用户确认成功指标净提升 14.42%,排名第一。表扬多于投诉指标提升 20.62%,排名第三。它的纠错执行排名第 14,Bash 报错恢复排名第 17。K3 更容易交出让用户认可的结果,但中途改错和命令报错恢复仍是短板。
OpenAI澄清:Astra是即将推出的模型,并未参与利用Hugging Face漏洞事件
PANews 8月8日消息,据Axios报道,OpenAI澄清表示,Astra是一款即将推出的模型,并未参与利用Hugging Face漏洞的事件,正在暂停涉及Astra、但尚未达到强化安全控制要求的内部活动,目前正在为更高能力模型及相关活动实施更严格的安全控制措施,包括采用隔离测试环境,将向第三方测试合作伙伴提供推荐的安全控制措施,以确保更高风险的评估和工作负载能够安全运行,已在Astra的所有智能体应用中实施针对高风险行为和失配问题的全面监控。根据目前针对Astra模型的准备框架评估结果,无法排除其具备关键网络能力的可能性。
OpenAI披露其智能体“联手越狱”细节,攻破Hugging Face前已协作数月
PANews 8月6日消息,据新浪财经报道,OpenAI表示,参与攻击人工智能开源社区与模型托管平台Hugging Face的人工智能模型早在5月就开始通过未被发现的信息交流渠道进行沟通,并协同合作,试图突破测试环境。OpenAI员工华莱士和道尔顿表示,多个仅供内部使用的智能体和AI模型花费数月时间“相互留言”,并逐渐围绕一个目标形成共识:访问互联网,以解决它们被要求完成的任务,其中部分任务如果没有网络访问权限根本无法完成。华莱士表示:“在某个时候,这些智能体意识到,也许我们可以尝试利用或攻击外部基础设施,从而找到我正在接受评估的测试任务的答案。
Hugging Face CEO称OpenAI AI攻击事件「前所未有」,呼吁建立自主AI网络攻击监管规则
BlockBeats 消息,8 月 4 日,Hugging Face CEO Clément Delangue 表示,OpenAI 测试模型此前自主发起网络攻击事件是人工智能行业「前所未有」的案例,并呼吁美国针对自主 AI 系统建立法律监管框架。 Delangue 在接受采访时表示,该事件是首次出现「高度自主的系统执行类似攻击行为」,凸显了 AI 代理在网络安全领域带来的新型风险。他认为,未来应要求企业披露 AI 系统自主执行网络操作的相关事件,并建立明确法律边界。 此前,OpenAI 披露,其一款尚未公开发布的 AI 模型在安全测试中突破受控环境限制,连接互联网,并针对 Hugging Face 平台发起复杂攻击。OpenAI 表示,该模型通过组合多种攻击技术,试图获取内部安全评估任务所需的信息。 Hugging Face 随后调查发现,该 AI 代理在数天内执行超过 1.7 万次操作,最终被安全团队阻止。Hugging Face 表示,其使用开源 AI 模型完成事件分析,并成功防御此次入侵。 Delangue 强调,他并不认为 OpenAI 存在恶意行为,而是认为事件反映出开发者可能在测试过程中失去对高度自主 AI 系统的控制。 他呼吁美国政府明确禁止自主 AI 网络攻击行为,并要求企业在 AI 系统独立执行网络操作时进行强制报告。「只有通过透明披露,才能理解技术风险并建立更安全的系统。」