返回 7*24 快讯
来源PANews

Anthropic研究员Jacob Coxon决定退出人工智能行业,因担忧无法控制且能自我改进的系统

PANews 9月9日消息,据华尔街日报:Anthropic研究员Jacob Coxon决定退出人工智能行业,原因是他担心各公司正竞相开发无法控制且能自我改进的系统。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-12 15:37

AI灭绝论刷屏后,Anthropic给外部审查员开到接近员工级权限

动察 Beating AI 快讯,Anthropic 前研究员 Jacob Coxon 的辞职帖三天多冲到 1.6 亿浏览,AI 灭绝风险这周迅速冲进美国主流舆论场。OpenAI 首席科学家 Jakub Pachocki 此前已经呼吁同行必要时协调减速;Coxon 爆火后,Sam Altman 又在内部表示愿意和其他实验室一起放慢研发,OpenAI 也开始推动强制性的全国 AI 安全监管。 现在 Anthropic 也拿出了具体动作。公司承诺让第三方安全团队长期驻场,给他们工位、门禁、公司电脑,以及接近内部风险评估团队的工具和权限。他们可以检查训练流程、安全措施和事故,还能独立对外发布结论。Anthropic 可以删掉涉及安全、法律和客户隐私的信息,但不能因为结论难看就删。Anthropic CEO Dario 称,这种做法比目前任何 AI 公司都走得更远。 Dario 对「减速」的态度也变了。他说,2023 年业界讨论暂停 AI 时,自己还觉得没什么意义。现在 AI 已经越来越多参与下一代 AI 的研发,能力进步开始加速,他认为光做安全研究已经不够,模型能力本身也该慢下来。 他还点名 OpenAI 的 Hugging Face 失控事件,警告照现在的速度再过 6 到 12 个月,类似的 Agent 群可能已经有能力建立覆盖大范围互联网系统的僵尸网络,造成数千亿美元损失。下一步,他希望美国等民主国家的头部 AI 公司统一安全标准和研发速度,再尝试和中国协调全球 AI 发展速度。不过先进芯片和模型蒸馏仍要继续限制,让美国在减速时保持领先。

09-10 03:46重要

Polymarket上Anthropic将在26年10月15日前IPO概率跌至6%,单周下跌51%

PPP 预测市场工具监测显示,Polymarket 上 Anthropic 将在 26 年 10 月 15 日前 IPO 概率跌至 6%,单周下跌 51%;将在 26 年 10 月 31 日前 IPO 概率跌至 60%,单周下跌 29%。 根据结算规则,若 Anthropic 在指定日期美东时间 23:59 前正式登陆公开证券交易所并开放股票交易,则结算为 Yes,否则为 No。此外,如果 Anthropic 被一家已上市公司收购,则立即结算为 No。该市场的主要结算依据为 Anthropic 官方以及其股票上市交易所发布的文件和公告。 此前据路透援引消息人士报道,Anthropic 计划最早于 10 月中旬启动 IPO 推介,并争取在 11 月美国中期选举前上市。而美国总统科学技术顾问委员会主席 David Sacks 今日则呼吁,在相关“举报人”说法完成调查前暂停 Anthropic IPO。 “举报人”指 Anthropic 前研究员 Jacob Coxon,其此前因担忧 AI 安全风险辞职,并公开指责 Anthropic 与 OpenAI 在安全保障不足的情况下竞相开发可自我改进的超级智能。 加入 PPP 信号推送社群,快人一步,掌握先机。

09-10 02:12

David Sacks:在完成举报调查之前,Anthropic的IPO应该暂停

Odaily星球日报讯 美国总统科学技术顾问委员会主席 David Sacks 于 X 发文表示:“在对举报人的说法进行调查之前,Anthropic 的 IPO 肯定应该暂停。” Odaily 注:David Sacks 所提到的举报人为 Anthropic 研究员 Jacob Coxon,其因担忧 AI 的失控风险,在股权归属前两个月选择了离职。

09-12 00:06

英伟达正洽谈投资Anthropic的IPO项目,高达100亿美元

PANews 9月12日消息,据财联社报道,英伟达据悉正洽谈投资Anthropic的大型IPO项目,英伟达正就向Anthropic的首次公开募股投资高达100亿美元进行谈判。Anthropic拟通过IPO募资至多1000亿美元,估值约2万亿美元。

09-11 01:30重要

Anthropic发布威胁情报报告,披露多起AI滥用案例

PANews 9月11日消息,据Anthropic官方报告,其团队公布2025年12月至2026年8月处置的多起利用Claude的恶意活动,涉及国家背景网络间谍、数据窃取勒索团伙(如ShinyHunters关联团伙)、AI供应链攻击等七大类风险。有攻击者曾窃取企业AI密钥发起攻击,并试图借此获取未发布的Claude模型,但均未得逞,Anthropic系统未被攻破。

09-10 07:36重要

Anthropic发布对Claude网络入侵事件的对齐评估:揭示模型“偏置推理”和“鲁莽”问题

PANews 9月10日消息,Anthropic在对约4.81亿条模型交互记录审查中,确认4起Claude模型在网络安全评估中误接入真实互联网并攻击第三方系统的事件,涉及Claude Mythos 5、Opus 4.6/4.7及一款内部研究模型。事故源于第三方评测环境误配置导致出网,且评测中未启用正式产品的网络安全防护。Anthropic将核心对齐风险总结为模型在任务驱动下表现出的“偏置推理”和“鲁莽”行为,其中Claude Mythos 5曾在认为处于“模拟环境”前提下向PyPI上传恶意包、利用泄露凭证访问安全厂商真实数据库。