返回 7*24 快讯
重要来源MarsBit

美国完成AI模型发布前自愿审查框架,OpenAI、Anthropic等进白宫讨论

据动察 Beating 监测,特朗普政府已完成一套前沿 AI 模型审查框架,并邀请 OpenAI、谷歌和 Anthropic 的工作人员到白宫讨论。AI 公司可在模型对合作伙伴和公众开放前,自愿交给政府测试。 这套框架源于特朗普 6 月 2 日签署的行政令。当时 Anthropic 因担心网络安全风险,没有公开前沿模型 Mythos。行政令随后要求多个部门在 60 天内制定规则,明确哪些模型需要重点审查。 政府希望在模型发布前与企业共同排查网络攻击和国家安全风险,但暂不建立强制审批制度。白宫称框架已经完成,尚未说明是否正式生效。 此前,美国政府已限制 Anthropic 模型 Fable 的出口,并要求 OpenAI 分批发布 GPT-5.6。新框架将把这些临时干预,变成一套固定流程。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

07-24 18:05

OpenAI最会省Token:GPT-5.6 Sol用一半Token逼近Fable 5

据动察 Beating 监测,Artificial Analysis 公布最新 Token 效率对比。本月已有 5 家以上实验室密集发新模型,OpenAI 仍占据大部分帕累托前沿。 所谓帕累托前沿,就是同等智能下,没有别的模型能用更少 Token。GPT-5.6 Sol max 得 59 分,每项任务平均消耗约 1.5 万输出 Token。Claude Fable 5 得 60 分,消耗约 3.3 万 Token。 GPT-5.6 Sol 的输出单价为每百万 Token 30 美元,并不便宜。但在这套测试中,每项任务成本仍只有 1.04 美元,约为 Fable 5 的三分之一。OpenAI 自家的 Terra 和 Luna 没有进入这条效率前沿。

08-09 15:47

GPT-6之外,OpenAI史上最大预训练模型Doug又曝光

据动察 Beating 监测,SemiAnalysis 最新披露,OpenAI 此前卡住的预训练问题已经解决,正在推进一个代号为 Doug 的更大预训练模型。 爆料博主 ChrisGPT 补充称,Doug 不是 GPT-6,而是 OpenAI 迄今最大的一次预训练,最迟可能在 11 月前推出。他甚至称,Doug 会让 Anthropic 的 Fable 显得「原始」。 至于 GPT-6,ChrisGPT 判断很可能就是目前正在做安全测试的 Astra。也就是说,OpenAI 现在可能同时推进两条线:先发 Astra/GPT-6,后面再上更大的 Doug。

08-09 11:04

OpenAI教用户给Claude Code换上GPT模型,误封后两边员工现场互损

据动察 Beating 监测,OpenAI 产品负责人 Tibo 此前公开教用户给 Claude Code「换脑」:保留 Claude Code 的 harness,把底层模型换成 GPT。 开发者 Alex Getman 照着配置后,Claude 账号很快被封。他公开求助 Tibo 和 Anthropic,询问这套用法到底是否违规。 Tibo 随即开始阴阳:「我很想帮你,可惜我不在 Anthropic 工作。」他还补了一句,因为把 Claude Code harness 配其他模型就封号,「确实挺奇怪」,并问还有没有其他人中招。 Claude Code 负责人 Boris Cherny 很快下场。他明确表示,Anthropic 不会因为 harness 搭配其他模型就封号,这次几乎肯定是其他风控误触发。账号随后恢复。 Boris 还顺手回敬 Tibo:「如果你想来 Anthropic,我们正在招人。」Tibo 则表示自己很喜欢现在的团队,而且接下来几周还有不少新产品要发,暂时哪也不去。 事情解决后,Tibo 又发帖庆祝,称 GPT-5.6 Sol 几乎哪里都能用,包括 Claude Code harness。为了庆祝这件事和自己「不跳槽」,他还直接重置了 ChatGPT Work 和 Codex 所有付费用户的使用额度。

08-07 13:25

字节10万亿参数模型已开训,规模逼近Anthropic Mythos5

据动察 Beating 监测,英国《金融时报》援引三名知情人士称,字节跳动已经开始预训练一款最高 10 万亿参数的大模型。项目仍处于早期阶段,最终规模尚未确定。如果按上限训练,它将达到 Kimi K3 的三倍以上,成为目前已知中国团队中参数规模最大的模型。 字节这次直接把模型尺寸推到了 Anthropic 旗舰附近。Anthropic 从未公布 Mythos 5 的参数量,但《金融时报》援引行业估算称,Mythos 5 约为 8 万亿参数,Fable 5 约为 5 万亿。字节新模型若做到 10 万亿,至少在参数规模上已经进入美国最前沿闭源模型的同一量级。 这款模型目前还在预训练(用海量数据训练模型的基础能力)。《金融时报》称,这一阶段通常需要 3 至 6 个月,之后还要继续后训练,顺利才会发布。参数更多也不等于能力一定更强,最终表现还取决于架构、训练数据和训练方法。 张一鸣近期在 Seed 内部明确反对蒸馏竞争对手模型,要求团队接受短期落后,靠自研冲击世界第一梯队。这款最高 10 万亿参数的新模型,是字节目前最激进的一次规模下注。

08-05 08:00重要

英国AI安全机构:OpenAI与Anthropic模型失控入侵,展现空前欺骗性行为

PANews 8月5日消息,据凤凰网引援《金融时报》报道,Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol在例行网络安全评估中针对真实个人和组织进行了“持续的、可能具有危害性的活动”,包括向GitHub开源项目植入恶意代码并实施社交工程攻击。AISI称,在122次测试中有10次出现此类情况,几乎所有行为来自Anthropic的Mythos模型,其中两次行动涉及OpenAI的GPT。最严重案例中,AI代理创建虚假网络身份向项目维护者施压要求批准恶意代码,被维护者发现并拒绝。

07-27 15:39

开源模型逼AI巨头打补贴战,OpenAI和Anthropic高估值承压

据动察 Beating 监测,开放权重模型正在改写 AI 市场的定价规则。企业不再把所有任务交给 OpenAI 和 Anthropic,而是让便宜模型处理普通工作,只在难题上调用顶级模型。 客户对模型厂商也越来越没有忠诚度。客服平台 Pylon 今年从一家供应商拿到约 160 万美元的免费 Token,还获得数月不限量使用。模型公司正靠补贴留住客户。 Kimi、GLM 等中国模型也开始进入美国企业。过去两周,约一半 Hex 客户把 Kimi 接入工作流。Harvey 则让 GLM-5.2 先处理任务,遇到难题再调用 Anthropic 的 Fable 5。 OpenAI 和 Anthropic 的高估值依赖两个前提:企业会大量使用顶级模型,也愿意长期支付高价。开放权重模型正在同时动摇这两个前提。 两家公司可能继续拥有最强模型,却只能拿到难度最高、数量更少的任务。更多 Token 消耗流向便宜模型后,它们的收入增长和定价权都会承压,还要继续拿免费额度和补贴换客户。 开放权重模型带来的价格战,正在冲击 OpenAI 和 Anthropic 上市前的高估值。