美科技政策办公室主任指控 Moonshot AI 蒸馏 Anthropic Fable 用于开发 K3
相关推荐
接连指控中国模型蒸馏后,Anthropic藏起Fable 5思考摘要
据动察 Beating 监测,Fable 5 已不再在网页端、桌面端和移动端展示思考摘要。模型仍在后台推理,用户只能看到最终答案。Anthropic 尚未解释原因,但这很可能是反蒸馏的最新措施。 今年 2 月,Anthropic 指控 DeepSeek、月之暗面和 MiniMax 使用约 2.4 万个虚假账号,与 Claude 交互超过 1600 万次。月之暗面被指专门提取并重建 Claude 的推理轨迹。 6 月,Anthropic 又指控阿里及千问关联操作者通过近 2.5 万个虚假账号,与 Claude 交互超过 2880 万次。7 月,Anthropic 国家安全负责人 Tarun Chhabra 首次点名智谱,称 GLM-5.2 蒸馏了 Claude 和 OpenAI 模型。Kimi K3 发布后,白宫科技政策办公室主任 Michael Kratsios 又指控月之暗面用 Fable 开发 K3。 Fable 5 已内置「推理提取」分类器,专门拦截套取思考摘要的请求。现在 Anthropic 又把聊天界面的思考摘要直接隐藏,外界只能拿到最终答案,更难批量收集模型的解题过程用于蒸馏。代价是普通用户也看不到模型正在做什么,长任务走偏时更难发现,也更难及时纠正或叫停。
月之暗面回应K3蒸馏Fable质疑:两者发布仅相隔15天
Odaily星球日报讯 月之暗面员工 Randy 在 X 平台发文回应白宫科技政策办公室主任 Michael Kratsios 关于 Moonshot AI 使用 Anthropic 的 Fable 蒸馏开发 K3 模型的言论。其表示,Fable 于 7 月 1 日公开亮相,K3 于 7 月 15 日推出,团队仅用 15 天训练了一个全新的前沿模型,堪称吉尼斯世界纪录级别。
Anthropic放宽Fable5生物限制,日常健康问题终于能正常答
据动察 Beating 监测,Anthropic 调整了 Claude Fable 5 的生物安全限制。此前生物问题一旦触发安全分类器,就会自动切到能力较弱的 Opus 5。新版分类器上线后,测试中的生物相关回退减少约 85%。化验结果解读、症状理解、生物学学习等普通问题,现在更容易直接用上 Fable 5。
微软CEO批评Anthropic对Fable模型的内容管控过于严苛
微软CEO萨蒂亚·纳德拉周三表示,Anthropic对用户向其高端人工智能模型 Fable 提交的查询设置各类限制,这种做法毫无道理。根据纳德拉讲话的文字稿,他对微软Copilot人工智能工具的研发工程师说道:“如果你用过 Fable 就会发现,它会莫名其妙拒绝各类指令。试问你什么时候见过一款创作工具会受到如此严苛的内容管控?这完全说不通。”据一份技术支持页面显示,当终端用户向 Fable 询问大规模模型搭建相关问题或其他话题时,Anthropic有时会调用旧版本模型生成回复。(新浪财经)
Anthropic延长Claude Fable 5模型付费用户访问权限至7月19日
火星财经消息 7月13日消息,人工智能公司Anthropic日前宣布,决定继续延长旗下Claude Fable 5旗舰模型在所有付费订阅方案中的访问权限,该政策的截止日期已由原定的7月12日推迟至7月19日。与此同时,Claude Code的每周费率上限也将继续保持在比常规标准高出50%的水平,直至同一日期。分析人士指出,Anthropic此举是在AI行业竞争日益激烈的背景下,为留住开发者所采取的策略之一。OpenAI的GPT-5.6系列模型于上周正式向公众开放,早期测试数据显示其在编程和逻辑推理任务中表现出色,甚至在某些维度上已追平或超越了Fable 5。(广角观察)
字节10万亿参数模型已开训,规模逼近Anthropic Mythos5
据动察 Beating 监测,英国《金融时报》援引三名知情人士称,字节跳动已经开始预训练一款最高 10 万亿参数的大模型。项目仍处于早期阶段,最终规模尚未确定。如果按上限训练,它将达到 Kimi K3 的三倍以上,成为目前已知中国团队中参数规模最大的模型。 字节这次直接把模型尺寸推到了 Anthropic 旗舰附近。Anthropic 从未公布 Mythos 5 的参数量,但《金融时报》援引行业估算称,Mythos 5 约为 8 万亿参数,Fable 5 约为 5 万亿。字节新模型若做到 10 万亿,至少在参数规模上已经进入美国最前沿闭源模型的同一量级。 这款模型目前还在预训练(用海量数据训练模型的基础能力)。《金融时报》称,这一阶段通常需要 3 至 6 个月,之后还要继续后训练,顺利才会发布。参数更多也不等于能力一定更强,最终表现还取决于架构、训练数据和训练方法。 张一鸣近期在 Seed 内部明确反对蒸馏竞争对手模型,要求团队接受短期落后,靠自研冲击世界第一梯队。这款最高 10 万亿参数的新模型,是字节目前最激进的一次规模下注。