返回 7*24 快讯
重要来源MarsBit

Meta涨超4%创逾一个月新高,发布最强AI模型Muse Spark 1.3

火星财经消息 9月3日,Meta盘初涨约4.5%,最高触及619.42美元,创7月22日以来新高。消息面上,Meta发布迄今最强大AI模型Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计。Meta首席AI官Alexandr Wang表示,该模型在编码能力上超越OpenAI的GPT-5.6 Sol,与Anthropic的Claude Fable 5.1表现持平。(科股宝播报)
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-08 08:22

Meta首席AI官Alexandr Wang驳斥SemiAnalysis「刷榜论」:老测试早已饱和

动察 Beating AI 快讯,AI 研究机构 SemiAnalysis 点名 Gemini 3.8 Flash 和 Muse Spark 1.3,称它们是目前最明显的「benchmaxxed」模型之一,也就是针对公开评测优化得太狠。两款模型在 Terminal-Bench 2.1 分别拿到 89.4% 和 88.8%,已经接近 GPT-6 Astra 和 Claude Fable 5.1;换到刚发布不久的 Terminal-Bench 4.0,却只剩 19.1% 和 33.3%。Astra 和 Fable 5.1 分别还有 57.7% 和 55.8%。 SemiAnalysis 怀疑,问题出在公开测试越来越容易被针对性优化。Terminal-Bench 2.1 的任务全部公开,即使模型厂商不直接拿测试题训练,也可以购买与这些任务高度相似的强化学习环境数据。模型于是越来越擅长这套考试,却未必能泛化到新任务。不过 SemiAnalysis 没有拿出 Google 或 Meta 购买这类数据的直接证据。 Meta 首席 AI 官 Alexandr Wang 随后反驳,称这个论点「很蠢」。他举例,GPT-5.6 Sol 同样从 Terminal-Bench 2.1 的 88.8% 掉到 4.0 的 37.3%。他的解释是 2.1 已经饱和,无法再有效区分顶尖模型,而 4.0 远未饱和。Terminal-Bench 4.0 的确删除了 8 道饱和、已有公开解法或存在其他问题的任务,同时修改了 19 道题,并重新调整时间、CPU 和内存等资源限制。

09-09 03:31

Alexandr Wang:Muse的早期使用量已远超我们的预期

PANews 9月9日消息,Meta Platforms(META.O)首席人工智能官Alexandr Wang:Muse的早期使用量已远超我们的预期。如今,Muse用户的使用量是我们测试组用户的10倍。

09-11 06:44

OpenAI将于下周下线GPT-5.3-Codex-Spark

PANews 9月11日消息,OpenAI Codex产品负责人Tibo在X平台发文称,OpenAI将于下周下线代码模型GPT-5.3-Codex-Spark,原因是该模型使用量持续下滑,且公司已推出性能更优的新模型。

09-05 15:35

Muse Spark 1.3 Max正式开放:最强推理档终于能用了

动察 Beating AI 快讯,Meta 正式开放 Muse Spark 1.3 Max。它是 Muse Spark 1.3 的最高推理强度,此前 1.3 发布时,max 还在做额外安全测试,只给少量合作伙伴预览。现在安全测试完成,已经能在 Muse Code 和 Meta Model API 里直接使用。 Meta 首席 AI 官 Alexandr Wang 称,Max 在编程和 Agent 任务上明显强于 high 和 xhigh。Artificial Analysis 的 Coding Agent Index 中,Muse Code + Muse Spark 1.3 Max 得到 68 分,已经进入第一梯队。

09-12 16:08

GPT-6 Astra 发布一周后遭用户吐槽变笨,OpenAI 尚未回应

ChainCatcher 消息,据 Decrypt 报道,OpenAI 最新旗舰模型 GPT-6 Astra 在发布一周后,X 平台上涌现大量用户吐槽其性能“变笨”的帖子。匿名开发者 synthwavedd 发文称“Astra 今天感觉明显变笨了”,并调侃这是“发布后脑叶切除手术”。此前曾称赞该模型的开发者 Pranjal Paliwal 在检查 Astra 为其编写的代码后表示:“我们没有 AGI,我们遇到的是性能回退。”开发者 Pankaj Kumar 列举了症状:回答更快、质量更差,并怀疑 OpenAI 调低了“juice value”(即模型在回答前投入的算力)。Salio 与研究员 Md Ismail Sojal 用相同提示词对比发布当天与当前的 Astra,均得到更差的结果。T3Chat 创始人 Theo 则认为 Astra 只是比 Claude Fable 更不稳定,用户蜜月期结束后开始集中晒出糟糕结果。也有观点指出,OpenAI 上一代旗舰 GPT-5.6 Sol 在 7 月就经历过同样的周期,当时 OpenAI 高管 Tibo Sottiaux 否认故意削弱模型,但承认公司一直在实验“推理努力”设置。OpenAI 尚未就 Astra 发布类似 Sol 的声明。

09-10 04:52

Meta重金挖来的AI大神不到一年就走了,曾拒最高15亿美元报价

动察 Beating AI 快讯,Meta AI 研究员 Andrew Tulloch 将离职,距他从 Mira Murati 的 Thinking Machines Lab 回归 Meta 还不到一年。Tulloch 在 Alexandr Wang 负责的 TBD Lab 工作,这是 Zuckerberg 当前 AI 战略的核心团队。Semafor 称,他早已准备离开,只是等 Meta 新一批开源 AI 模型和个人 Agent Muse 发布完才走。 2025 年,Meta 曾给 Tulloch 开出一份最高可达 15 亿美元、至少 6 年的薪酬方案,但他当时拒绝。这个数字包含最高奖金和 Meta 股价大涨后的潜在收益。几个月后,Tulloch 还是加入了 Meta,但 Axios 称实际薪酬低于此前那份报价,具体金额没有公开。 Tulloch 此前已经在 Meta 工作 11 年,2023 年转去 OpenAI,之后参与创办 Thinking Machines Lab。现在他的下一站仍不清楚,离职原因也没有公开。