返回 7*24 快讯
来源ODAILY

Kimi K3实测3D建模:成本不到Claude Fable 5一半,原始风格生成效果接近

Odaily星球日报讯 Kimi 官推转发实测 3D 建模结果,要求与 Anthropic 的 Claude Fable 5 在最高算力模式下复刻《星球大战》中的“千年隼号”挑战像素风格和原始风格。测试结果显示,Kimi K3 生成速度略慢于 Fable 5,但成本优势明显。 首次像素风格测试中,Kimi K3 耗时 1 小时 11 分钟,成本 14.5 美元;Claude Fable 5 耗时 49 分钟,成本 21 美元。二次原始风格测试 Kimi K3 耗时 1 小时 17 分钟,成本 19.3 美元;Claude Fable 5 耗时 1 小时 5 分钟,成本 47.2 美元。从效果来看,Kimi K3 在原始风格 3D 建模中对细节处理能力已接近 Fable 5 水平,但在像素风格任务上仍存在一定差距。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

07-24 16:14

接连指控中国模型蒸馏后,Anthropic藏起Fable 5思考摘要

据动察 Beating 监测,Fable 5 已不再在网页端、桌面端和移动端展示思考摘要。模型仍在后台推理,用户只能看到最终答案。Anthropic 尚未解释原因,但这很可能是反蒸馏的最新措施。 今年 2 月,Anthropic 指控 DeepSeek、月之暗面和 MiniMax 使用约 2.4 万个虚假账号,与 Claude 交互超过 1600 万次。月之暗面被指专门提取并重建 Claude 的推理轨迹。 6 月,Anthropic 又指控阿里及千问关联操作者通过近 2.5 万个虚假账号,与 Claude 交互超过 2880 万次。7 月,Anthropic 国家安全负责人 Tarun Chhabra 首次点名智谱,称 GLM-5.2 蒸馏了 Claude 和 OpenAI 模型。Kimi K3 发布后,白宫科技政策办公室主任 Michael Kratsios 又指控月之暗面用 Fable 开发 K3。 Fable 5 已内置「推理提取」分类器,专门拦截套取思考摘要的请求。现在 Anthropic 又把聊天界面的思考摘要直接隐藏,外界只能拿到最终答案,更难批量收集模型的解题过程用于蒸馏。代价是普通用户也看不到模型正在做什么,长任务走偏时更难发现,也更难及时纠正或叫停。

08-08 14:34

Anthropic升级Claude新增预算控制、区域推理、技能加载与模型顾问功能

Odaily星球日报讯 Anthropic 本周对 Claude 进行升级,为 Claude Managed Agents 推出四项重要更新,进一步增强企业级 AI Agent 的可控性、部署灵活性和任务执行能力,包括: 1、新增会话预算控制功能,用户现在可以为 Agent 会话设置预算上限,以实现更精准的成本管理。当会话达到预算限制后,系统将触发事件并暂停运行,用户可提高预算后恢复任务执行。 2、开放推理区域控制能力,用户可以选择 Claude Managed Agents 运行位置,在全球可用资源中调度运行并按照标准价格计费,如果限制在美国区域运行,满足区域部署需求,但费用为标准价格的 1.1 倍。 3、支持自动加载用户仓库中的 Skills 能力模块; 4、新增顾问模型功能。用户可以配置一个更强大的模型作为“顾问”,让执行任务的 Agent 在会话过程中调用顾问模型进行第二意见分析,提高复杂任务处理质量。

08-07 12:31

Anthropic放宽Fable5生物限制,日常健康问题终于能正常答

据动察 Beating 监测,Anthropic 调整了 Claude Fable 5 的生物安全限制。此前生物问题一旦触发安全分类器,就会自动切到能力较弱的 Opus 5。新版分类器上线后,测试中的生物相关回退减少约 85%。化验结果解读、症状理解、生物学学习等普通问题,现在更容易直接用上 Fable 5。

07-28 02:27

Anthropic Claude共享对话被Google索引,暴露加密钱包助记词等敏感信息

Odaily星球日报讯 7 月 25 日,一名 Reddit 用户通过 Google 搜索“site:claude.ai/share”发现数百条可完整阅读的 Claude 共享对话。相关内容包括加密钱包助记词、疑似社会安全号码、法律讨论等敏感信息。 问题原因是 Anthropic 未在 Claude 共享页面添加 noindex 元标签。其 robots.txt 已阻止 Claude 共享 URL 抓取,但当共享链接出现在公开网站时,Google 仍可索引相关页面。 同一问题还涉及 Claude 公开 artifacts,包括用户在 Claude 内创建的应用、仪表盘和金融工具。相关搜索结果曾显示含员工姓名的薪资表、内部客户关系管理聊天导出和未发布产品路线图。 7 月 26 日前,Anthropic 更新配置并添加 noindex 标签后,Google 开始移除 Claude 相关结果。Bing 仍显示部分共享链接;一个 GitHub 仓库已归档 453 条 Claude 对话和 519 条 Grok 对话,共 11241 条明文消息。

07-22 16:17

Kimi K3白领任务逼近Fable5,成本升至上代10倍

据动察 Beating 监测,Artificial Analysis 更新 AA-Briefcase 榜单。这个评测让模型从近 2000 份邮件、Slack 记录和公司文件中找信息,再交付表格、演示文稿和界面原型。它共设 4 个长期项目和 91 项保密任务。 Kimi K3 得分 1543 Elo,仅次于 Claude Fable 5 的 1574。它超过 GPT-5.6 Sol 的 1501,也领先 Claude Sonnet 5 和 Claude Opus 4.8。 K3 的客观要求通过率为 51%,Fable 5 为 56%。但 K3 的分析质量得分略高,1754 对 1744。它主要输在成品展示,低于 GPT-5.6 Sol 和 Opus 4.8。 性能提升也伴随着更高的 Token 消耗。K3 平均每项任务花费 10.57 美元,约为 Kimi K2.6 的 10 倍。它平均执行 83 轮,输出 12 万 Token,耗时 56.4 分钟。完成同类任务所需时间约为 Fable 5 的 2.5 倍。

07-20 19:35重要

SemiAnalysis:Kimi K3跻身全球第三,或揭示OpenAI与Anthropic隐藏利润空间

火星财经消息,7 月 20 日,SemiAnalysis 分析师 Jordan Nanos 和 Max Kan 近日围绕月之暗面旗下模型 Kimi K3 展开分析,认为该模型在综合基准测试中超越 Google Gemini,不仅反映中美 AI 模型差距缩小,也为推测 Anthropic 和 OpenAI 等闭源 AI 公司的商业模式提供了新视角。 根据 SemiAnalysis 综合评价,Kimi K3 目前排名全球第三,仅次于 Fable 5 和 GPT-5.6,并超过 Google Gemini。分析师表示,虽然这一结果并不意味着 Google AI 业务出现重大问题,但 Kimi K3 公开披露的参数规模、性能和定价,为外界估算闭源模型经济价值提供了参考。 Kimi K3 拥有 2.8 万亿参数,远超多数公开模型。Jordan Nanos 表示,如此规模的模型无法部署在单个英伟达 B200 GPU 上,需要 GB300、B300 级别系统或 AMD MI355X 等更高规格硬件支持。他据此推测,Anthropic 和 OpenAI 的旗舰闭源模型可能也处于类似参数规模,而非拥有数量级领先优势。 在商业模式方面,Kimi K3 上线价格接近 Anthropic Sonnet 系列模型,输入价格约为每百万 token 3 美元,输出价格约为每百万 token 15 美元,较上一代 Kimi 模型价格上涨约 3 倍。 Max Kan 认为,如果月之暗面并非长期亏损运营,那么 Anthropic 和 OpenAI 针对类似规模模型收取更高价格,意味着其 API 业务可能具备较高利润率。「出售 API token 可能比 SaaS 更赚钱。」他说。 不过,两位分析师强调,上述判断并非基于 AI 公司的公开财务数据,而是通过 Kimi K3 的参数、价格和性能表现进行反向推演。