Sakana Fugu与Fable 5跑分对比遭质疑,测试脚手架差异可致10-20分偏差
相关推荐
Anthropic放宽Fable5生物限制,日常健康问题终于能正常答
据动察 Beating 监测,Anthropic 调整了 Claude Fable 5 的生物安全限制。此前生物问题一旦触发安全分类器,就会自动切到能力较弱的 Opus 5。新版分类器上线后,测试中的生物相关回退减少约 85%。化验结果解读、症状理解、生物学学习等普通问题,现在更容易直接用上 Fable 5。
接连指控中国模型蒸馏后,Anthropic藏起Fable 5思考摘要
据动察 Beating 监测,Fable 5 已不再在网页端、桌面端和移动端展示思考摘要。模型仍在后台推理,用户只能看到最终答案。Anthropic 尚未解释原因,但这很可能是反蒸馏的最新措施。 今年 2 月,Anthropic 指控 DeepSeek、月之暗面和 MiniMax 使用约 2.4 万个虚假账号,与 Claude 交互超过 1600 万次。月之暗面被指专门提取并重建 Claude 的推理轨迹。 6 月,Anthropic 又指控阿里及千问关联操作者通过近 2.5 万个虚假账号,与 Claude 交互超过 2880 万次。7 月,Anthropic 国家安全负责人 Tarun Chhabra 首次点名智谱,称 GLM-5.2 蒸馏了 Claude 和 OpenAI 模型。Kimi K3 发布后,白宫科技政策办公室主任 Michael Kratsios 又指控月之暗面用 Fable 开发 K3。 Fable 5 已内置「推理提取」分类器,专门拦截套取思考摘要的请求。现在 Anthropic 又把聊天界面的思考摘要直接隐藏,外界只能拿到最终答案,更难批量收集模型的解题过程用于蒸馏。代价是普通用户也看不到模型正在做什么,长任务走偏时更难发现,也更难及时纠正或叫停。
Anthropic最强模型Fable5和Mythos5明日解封
据动察 Beating 监测,Anthropic 发布公告称,美国商务部已解除对 Claude Fable 5 和 Mythos 5 的出口管制,将于明天开始恢复访问,并将很快分享更新。
美科技政策办公室主任指控 Moonshot AI 蒸馏 Anthropic Fable 用于开发 K3
火星财经消息,美国白宫科技政策办公室主任 Michael Kratsios 发文称,已掌握信息显示 Moonshot AI 通过搭建大规模内部平台,对 Anthropic 的 Fable 模型进行蒸馏,用于开发其 K3 模型,并多次切换访问方式以规避检测。他还指出,Moonshot AI 已采购 GB300 服务器并访问了泰国的 GB300 设备,可能用于训练 AI 模型。Kratsios 表示,美方支持合法蒸馏与开放创新,但反对以大规模秘密工业蒸馏手段窃取美国技术。目前 Moonshot AI 尚未就此公开回应。
微软CEO批评Anthropic对Fable模型的内容管控过于严苛
微软CEO萨蒂亚·纳德拉周三表示,Anthropic对用户向其高端人工智能模型 Fable 提交的查询设置各类限制,这种做法毫无道理。根据纳德拉讲话的文字稿,他对微软Copilot人工智能工具的研发工程师说道:“如果你用过 Fable 就会发现,它会莫名其妙拒绝各类指令。试问你什么时候见过一款创作工具会受到如此严苛的内容管控?这完全说不通。”据一份技术支持页面显示,当终端用户向 Fable 询问大规模模型搭建相关问题或其他话题时,Anthropic有时会调用旧版本模型生成回复。(新浪财经)
Anthropic延长Claude Fable 5模型付费用户访问权限至7月19日
火星财经消息 7月13日消息,人工智能公司Anthropic日前宣布,决定继续延长旗下Claude Fable 5旗舰模型在所有付费订阅方案中的访问权限,该政策的截止日期已由原定的7月12日推迟至7月19日。与此同时,Claude Code的每周费率上限也将继续保持在比常规标准高出50%的水平,直至同一日期。分析人士指出,Anthropic此举是在AI行业竞争日益激烈的背景下,为留住开发者所采取的策略之一。OpenAI的GPT-5.6系列模型于上周正式向公众开放,早期测试数据显示其在编程和逻辑推理任务中表现出色,甚至在某些维度上已追平或超越了Fable 5。(广角观察)