返回 7*24 快讯
来源MarsBit

Cursor自动挑模型:满意度接近Fable,成本低60%

据动察 Beating 监测,Cursor 推出 Cursor Router,面向 Teams 和 Enterprise 自动选择编程模型。它会先判断任务类型和难度,再决定调用便宜模型还是前沿模型。 Router 使用超过 60 万次真实请求训练,并在数百万次请求中测试。Auto Intelligence 的用户满意度接近 Fable,成本低约 60%。Auto Balance 的满意度高于 Opus 4.8,成本低约 36%。 Cursor 没有公布完整模型池,也不会默认显示每次调用了哪个模型。官方只确认,Router 会按任务类型分配模型,例如把界面设计交给更擅长视觉的模型,把复杂长任务交给推理能力更强的模型。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

06-14 11:31

OpenRouter推出Fusion复合模型:多模型并联合成,半价匹敌Fable 5

据动察 Beating 监测,OpenRouter 推出 Fusion 复合模型接口,支持将用户提示词并行分发给多个大语言模型,再通过裁判模型与合成模型输出最终解答。在 Perplexity AI 发布的 DRACO 深度研究基准测试中,基于 Fusion 的多种模型组合展现出对传统单模型的压制力。在各项配置中,将 Fable 5 与 GPT-5.5 组成面板并在 Opus 4.8 的合成下取得了 69.0% 的最高分,显著超越了 Fable 5 单模型运行的 65.3% 成绩。测试表明,由于不同厂商模型的底层训练与逻辑差异,多模型混搭的多样性在复杂任务中能带来更强的视角互补。 即使是同一种模型进行左右互搏也表现出明显增幅,将 Opus 4.8 与自身组成双面板进行自我合成,得分能从独立运行的 58.8% 提升至 65.5%。对于高性价比需求,由 Gemini 3 Flash、Kimi K2.6 与 DeepSeek V4 Pro 组成的低成本面板同样在合成下取得了 64.7% 的分数,在调用成本减半的情况下,与 Fable 5 的差距缩短至 0.6 个百分点。 基准测试包含 10 个维度的 100 项复杂研究任务。为了防止模型在检索中意外访问到在线评测标准导致得分失真,OpenRouter 在服务端配置了过滤检索域名列表。目前 Fusion 已对 API 用户开放,默认标识符为 openrouter/fusion,用户也可在网页端自定义参与合成的模型面板。

06-25 18:41

Notion公测Claude与Cursor智能体:看板直接派活,支持外部订阅

据动察 Beating 监测,Notion 宣布在 Business 与 Enterprise 计划中公测外部智能体 (External Agents) 平台,支持将 Anthropic 旗下 Claude 以及 AI 编程工具 Cursor 接入团队协作看板。团队可在 Notion 工作区内像提及同事一样 @ 智能体,或在任务板上直接指派任务,让 AI 在后台自动协同完成代码编写、数据分析与内容生成等工作。 对普通办公用户而言,新公测的 Claude 智能体基于 Anthropic 托管智能体 (CMA) 架构运行。用户无须配置复杂的 API 密钥,直接通过 Notion 点数 (Notion credits) 按运行次数付费。将任务卡片分配给智能体后,模型能够自主读取关联文档并执行多步规划,但也需注意,由于 CMA 架构是有状态运行,Notion 现有的零数据残留 (ZDR) 承诺不适用于 Claude 智能体,会话数据会留存在服务器端。 针对开发团队,Notion 开放了外部智能体接口。用户可将本地运行的 Cursor 智能体与 Notion 工作区绑定。例如在 Notion 看板指派编码任务后,Cursor 会在本地运行环境中利用用户的个人订阅完成代码开发并提交 Pull Request,最后将执行结果与 PR 链接自动写回 Notion 任务页面,实现零 Notion 点数消耗的开发自动化。

08-12 13:27

Grok 4.6发布进入倒计时:官网开关已经埋好,Cursor也提前泄露

据动察 Beating 监测,Grok 4.6 看起来已经离正式发布不远。开发者发现,Grok 官网前端已经出现 enable_grok_4_6_announcement 功能开关。目前状态仍为 false,说明相关发布入口已经预留,但还没有正式开启。 此前 Grok 4.6 曾短暂出现在 Cursor 的模型列表中,随后又被撤下。页面显示它提供 256K 上下文,并面向复杂、长时间运行的 Agent 编程任务。不过 Cursor 和 SpaceXAI 都还没有正式宣布上线。

08-11 09:08

Cursor提前泄漏Grok 4.6,马斯克称本周上线

据动察 Beating 监测,尚未正式发布的 Grok 4.6,今天短暂出现在 Cursor 模型列表。页面将它标为「Cursor Grok 4.6 Fast」。它主要面向复杂、长时间运行的 Agent 编程任务。界面还显示 256K 上下文和 high effort 模式。 但模型选中后无法调用。这更像一次提前露出,并非正式上线。 马斯克此前称,Grok 4.6 是 1.5 万亿参数模型。升级重点是监督微调和强化学习。他最初预告 8 月 7 日左右发布,之后在 SpaceX 首次财报会议上又改称可能在本周上线。

08-09 10:18

SpaceX最快下周完成对Cursor的收购,Cursor品牌可能就此淡出

据动察 Beating 监测,Cursor 在内部全员会上透露,SpaceX 对公司的 600 亿美元收购最快可能在下周完成,最晚预计本月底交割。 收购完成后,Cursor 不会继续作为独立团队存在,而是并入 SpaceXAI。Cursor 品牌也可能逐步淡出,新产品未来可能改用 Grok 或其他名字。正在开发的通用 Agent「Sand」就可能改名为「Grok Bot」。现有 Cursor 编程助手暂时不会改名。

08-07 12:31

Anthropic放宽Fable5生物限制,日常健康问题终于能正常答

据动察 Beating 监测,Anthropic 调整了 Claude Fable 5 的生物安全限制。此前生物问题一旦触发安全分类器,就会自动切到能力较弱的 Opus 5。新版分类器上线后,测试中的生物相关回退减少约 85%。化验结果解读、症状理解、生物学学习等普通问题,现在更容易直接用上 Fable 5。