返回 7*24 快讯
来源MarsBit

Karpathy评Fable 5:软件如自来水般涌出,首次让人想完全不看代码

据动察 Beating 监测,OpenAI 联合创始人、上月加盟 Anthropic 的 Andrej Karpathy 也对 Anthropic 全新发布的 Fable 5 大模型给予高度评价。Karpathy 指出,Fable 5 代表了一次具备版本跨代意义的性能跃迁,特别擅长处理长链路的复杂调试任务。他表示,在面对宏大开发目标时,新模型能够迅速领会意图并自主推进,甚至让人首次产生想要完全不看代码的强烈冲动,但 Karpathy 警告切勿在生产环境中这样做。 Karpathy 强调,当可用软件能够像自来水般源源不断地产出时,软件领域的杰文斯悖论 (Jevons paradox) 将被触发,开发者的需求将呈指数级增长。杰文斯悖论的触发将促使人们去创造大量超特异性 (hyper-specific) 的单次使用工具与海量测试集。不过 Karpathy 也指出,发布初期的安全防护机制配置依然过于敏感,有待后续优化。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-04 12:17重要

美国完成AI模型发布前自愿审查框架,OpenAI、Anthropic等进白宫讨论

据动察 Beating 监测,特朗普政府已完成一套前沿 AI 模型审查框架,并邀请 OpenAI、谷歌和 Anthropic 的工作人员到白宫讨论。AI 公司可在模型对合作伙伴和公众开放前,自愿交给政府测试。 这套框架源于特朗普 6 月 2 日签署的行政令。当时 Anthropic 因担心网络安全风险,没有公开前沿模型 Mythos。行政令随后要求多个部门在 60 天内制定规则,明确哪些模型需要重点审查。 政府希望在模型发布前与企业共同排查网络攻击和国家安全风险,但暂不建立强制审批制度。白宫称框架已经完成,尚未说明是否正式生效。 此前,美国政府已限制 Anthropic 模型 Fable 的出口,并要求 OpenAI 分批发布 GPT-5.6。新框架将把这些临时干预,变成一套固定流程。

07-27 15:39

开源模型逼AI巨头打补贴战,OpenAI和Anthropic高估值承压

据动察 Beating 监测,开放权重模型正在改写 AI 市场的定价规则。企业不再把所有任务交给 OpenAI 和 Anthropic,而是让便宜模型处理普通工作,只在难题上调用顶级模型。 客户对模型厂商也越来越没有忠诚度。客服平台 Pylon 今年从一家供应商拿到约 160 万美元的免费 Token,还获得数月不限量使用。模型公司正靠补贴留住客户。 Kimi、GLM 等中国模型也开始进入美国企业。过去两周,约一半 Hex 客户把 Kimi 接入工作流。Harvey 则让 GLM-5.2 先处理任务,遇到难题再调用 Anthropic 的 Fable 5。 OpenAI 和 Anthropic 的高估值依赖两个前提:企业会大量使用顶级模型,也愿意长期支付高价。开放权重模型正在同时动摇这两个前提。 两家公司可能继续拥有最强模型,却只能拿到难度最高、数量更少的任务。更多 Token 消耗流向便宜模型后,它们的收入增长和定价权都会承压,还要继续拿免费额度和补贴换客户。 开放权重模型带来的价格战,正在冲击 OpenAI 和 Anthropic 上市前的高估值。

07-24 16:14

接连指控中国模型蒸馏后,Anthropic藏起Fable 5思考摘要

据动察 Beating 监测,Fable 5 已不再在网页端、桌面端和移动端展示思考摘要。模型仍在后台推理,用户只能看到最终答案。Anthropic 尚未解释原因,但这很可能是反蒸馏的最新措施。 今年 2 月,Anthropic 指控 DeepSeek、月之暗面和 MiniMax 使用约 2.4 万个虚假账号,与 Claude 交互超过 1600 万次。月之暗面被指专门提取并重建 Claude 的推理轨迹。 6 月,Anthropic 又指控阿里及千问关联操作者通过近 2.5 万个虚假账号,与 Claude 交互超过 2880 万次。7 月,Anthropic 国家安全负责人 Tarun Chhabra 首次点名智谱,称 GLM-5.2 蒸馏了 Claude 和 OpenAI 模型。Kimi K3 发布后,白宫科技政策办公室主任 Michael Kratsios 又指控月之暗面用 Fable 开发 K3。 Fable 5 已内置「推理提取」分类器,专门拦截套取思考摘要的请求。现在 Anthropic 又把聊天界面的思考摘要直接隐藏,外界只能拿到最终答案,更难批量收集模型的解题过程用于蒸馏。代价是普通用户也看不到模型正在做什么,长任务走偏时更难发现,也更难及时纠正或叫停。

08-07 12:31

Anthropic放宽Fable5生物限制,日常健康问题终于能正常答

据动察 Beating 监测,Anthropic 调整了 Claude Fable 5 的生物安全限制。此前生物问题一旦触发安全分类器,就会自动切到能力较弱的 Opus 5。新版分类器上线后,测试中的生物相关回退减少约 85%。化验结果解读、症状理解、生物学学习等普通问题,现在更容易直接用上 Fable 5。

08-05 12:19

谷歌Gemini 3.5 Pro传8月10日发布,爆料称难敌OpenAI和Anthropic

据动察 Beating 监测,爆料博主 Dan 称,谷歌可能在 8 月 10 日发布 Gemini 3.5 Pro。Dan 最初预告 8 月 12 日,数小时后又把日期改为 8 月 10 日。 谷歌 5 月曾称 Pro 版将在 6 月推出,但最终跳票。7 月 21 日,谷歌只表示模型正在与合作伙伴测试,准备好后会尽快开放。延迟与编程能力未达到内部目标有关。 Dan 还判断,新模型整体会很强,但未必能明显超过 Anthropic 和 OpenAI 的顶级模型。

07-26 11:22

开源AI联署两天翻倍:OpenAI、谷歌加入,Anthropic没签

据动察 Beating 监测,美国正讨论是否限制可以下载和自行部署的开源模型。英伟达、微软等公司随后发布《开放权重与美国AI领导力》公开信,呼吁政府不要过早设限。签署名单已从首发的 25 家增至 50 家,OpenAI、Google、AMD、Cloudflare、GitHub 和 Cisco 等公司后来加入。 OpenAI 和 Google 虽然靠 GPT、Gemini 等闭源旗舰收费,也分别推出了 gpt-oss 和 Gemma 开放模型。签字不会影响它们继续卖闭源模型,却能保住开放模型这张牌。 Anthropic 没有签,也符合它现有的产品和政策路线。它没有 gpt-oss、Gemma 这类开放权重产品,近期又不断强调非法蒸馏和模型泄露风险。 此外,Amazon/AWS、Apple 和 xAI 也没有正式签署。马斯克只是在 X 上公开支持,xAI 并未出现在官方名单。