Anthropic出口限制持续两周,亚洲AI企业加速推出本土替代方案
相关推荐
Sakana Fugu与Fable 5跑分对比遭质疑,测试脚手架差异可致10-20分偏差
据动察 Beating 监测,日本 AI 初创公司 Sakana AI 研发的多智能体协同系统 Fugu Ultra 宣称在科学推理与编程等多项基准测试中击败 Anthropic 旗舰模型 Fable 5,但跑分结论遭到社区普遍质疑。 批评指出,在非统一考场下对比自测数据并不客观。测试跑分高度依赖于运行脚手架(Scaffold/Harness),不同脚手架带来的跑分偏差可达 10 到 20 分,这使得所谓的「超越」在很大程度上只是系统工程调优的产物,而非底层模型能力的跨代超越。 独立的评测数据表明,围绕大模型构建的智能体运行脚手架对最终得分影响巨大。在同一个 Claude Opus 4.5 模型下,仅更换三款不同的开源脚手架,在 SWE-bench Pro 基准测试中的修复率就会出现 50.2% 至 55.4% 的波动。第三方测试机构 Scale AI 的分析进一步证实,提示词模板、尝试次数上限、上下文留存管理以及工具调用集成等运行策略,足以导致同一组模型权重产生 10 到 20 分的跑分偏差。 由于 Sakana AI 和 Anthropic 公布的数据均基于各自专为自家系统调优的闭源脚手架(Vendor Scaffold),而未在标准化的独立第三方环境(如 Scale SEAL)下进行统一测试,数据并不能真实反映出两款模型底层能力的强弱。
Anthropic最强模型Fable5和Mythos5明日解封
据动察 Beating 监测,Anthropic 发布公告称,美国商务部已解除对 Claude Fable 5 和 Mythos 5 的出口管制,将于明天开始恢复访问,并将很快分享更新。
Anthropic 与美政府达成 Fable 出口解禁协议细节不公开引发争议
PANews 7月1日消息,据彭博社报道,Anthropic 与美国政府达成协议后,其 Fable 5 和 Mythos 5 模型的对外访问限制被撤销,但双方在安全标准和技术改动上的具体约定并未公开。此前,禁令源于 Amazon 向美政府反馈 Fable 安全防护可被绕过,Anthropic 此后在美国商务部下属 CAISI 支持下修补相关缺陷,并同意与 CAISI 深化合作,提供算力和安全团队参与测试。报道指出,这一以私下通信和闭门谈判达成的出口管制案例缺乏透明度,令企业难以预判未来在何种标准下可能再遭封堵。
美国允许受信任的伙伴使用Anthropic的Mythos 5人工智能模型
PANews 6月27日消息,据财联社报道,美国商务部在信函中表示,美国放宽了对“可信赖的伙伴”使用Anthropic PBC的高端Mythos 5人工智能模型的限制。此举缓和了Anthropic与美国政府之间的争端。此前,美国政府援引安全担忧,突然禁止Anthropic向外国公民开放Fable 5和Mythos 5。这封日期为周五的信函并未提及对Fable 5模型使用限制的任何调整。美国商务部发言人Benno Kass表示:“在短短两周内,我们辛勤工作,以确保美国在维护国家安全的同时,继续保持在全球人工智能领域的领导地位。”
字节10万亿参数模型已开训,规模逼近Anthropic Mythos5
据动察 Beating 监测,英国《金融时报》援引三名知情人士称,字节跳动已经开始预训练一款最高 10 万亿参数的大模型。项目仍处于早期阶段,最终规模尚未确定。如果按上限训练,它将达到 Kimi K3 的三倍以上,成为目前已知中国团队中参数规模最大的模型。 字节这次直接把模型尺寸推到了 Anthropic 旗舰附近。Anthropic 从未公布 Mythos 5 的参数量,但《金融时报》援引行业估算称,Mythos 5 约为 8 万亿参数,Fable 5 约为 5 万亿。字节新模型若做到 10 万亿,至少在参数规模上已经进入美国最前沿闭源模型的同一量级。 这款模型目前还在预训练(用海量数据训练模型的基础能力)。《金融时报》称,这一阶段通常需要 3 至 6 个月,之后还要继续后训练,顺利才会发布。参数更多也不等于能力一定更强,最终表现还取决于架构、训练数据和训练方法。 张一鸣近期在 Seed 内部明确反对蒸馏竞争对手模型,要求团队接受短期落后,靠自研冲击世界第一梯队。这款最高 10 万亿参数的新模型,是字节目前最激进的一次规模下注。
欧盟与Anthropic就Mythos的访问问题继续进行讨论
PANews 6月29日消息,市场消息:欧盟与Anthropic就Mythos的访问问题继续进行讨论。