DeepSeek V4强得像Fable 5,社区怀疑API偷偷换了模型
相关推荐
Claude Code自己给AI应用调优:改Prompt、换模型,变差就回滚
动察 Beating AI 快讯,Anthropic 给 Claude Code 的官方 claude-api Skill 加了一套自动调优工作流。build-eval 先从真实对话、Bug 或人工案例里做出测试集和评分方法,hillclimb 再让 Claude Code 反复修改系统 Prompt、工具说明、模型和推理强度。每次改完都重新跑测试,效果变好就保留,变差就回滚。 为了避免 Claude 只针对测试题优化,它不会拿所有样本一起调。部分案例用于找问题和改配置,另留一批案例检查修改能不能用在没见过的问题上。如果前面的分数涨了,留出的测试结果没有改善,这次修改就可能被判定为过拟合并撤回。 Anthropic 用 44 条客服工单演示了这套流程。Claude Code 先后清理 Prompt、补充业务规则、尝试不同模型并降低推理强度。最终找到一套 Sonnet 5 低 effort 配置。在 14 条没有参与调优的工单上,准确率从初始配置的 78.6% 提到 90.5%,成本降到约原来的五分之一。
Claude创业扶持放宽:自筹团队也能拿API额度
动察 Beating AI 快讯,Anthropic 扩大 Claude Startups 创业扶持计划。旧版规则允许早期创业团队加入项目,但想拿 API 额度和额外福利,必须已经获得机构股权投资。现在公司成立不超过 5 年,或最近 2 年获得过融资即可申请。Anthropic 明确写明,自筹资金、Pre-seed 阶段和已获风投的创业公司都在范围内。 获批公司可免费使用 1 年 Claude Team,最多 5 个 Premium 席位。每家公司另有 1000 美元 Claude API 额度,有效期 6 个月。Team 免费资格只面向此前没有订阅过 Team 的公司。 Anthropic 还上线 Claude Startup Stack。Linear、Lovable、ElevenLabs、Granola、Hex 等公司会提供折扣和额度,标称总价值最高 4.5 万美元。成员还能预约 Anthropic Applied AI 团队做一对一技术答疑,并获得构建 Claude Marketplace 连接器和插件、提交审核等方面的协助。 这批额外福利的条款里还有一项容易被忽略的规定。创业公司如果在 Anthropic Applied AI 的咨询中透露产品架构等机密信息,Anthropic 可以继续使用员工仅凭记忆留下的一般性想法、经验和技术。条款还明确,不会限制 Anthropic 独立开发类似或竞争性技术,但不得直接披露这些机密信息,也没有获得相关专利或版权许可。
AI订阅大摸底:Claude补贴比国产Coding Plan还狠
动察 Beating AI 快讯,SemiAnalysis 把 OpenAI、Anthropic、Meta、SpaceXAI、MiniMax、月之暗面、智谱、Cursor 和 Cognition 的 AI 订阅套餐逐个测了一遍。它分别测试输入、缓存写入、缓存读取和输出会消耗多少订阅额度,再按自己 9 月的 Agent 使用结构计算,其中约 96.6% 是缓存读取。最后再套用各家的 API 标价,看同样一批 token 如果直接走 API,需要花多少钱。SemiAnalysis 将这个数字称为「API 等价价值」。 Claude 的 Sonnet 和 Opus 补贴最狠。同样每月 200 美元的 Max 20x,使用 Sonnet 5.5 最多可跑出约 12,529 美元的 API 用量,相当于月费的 62.6 倍;Opus 5.5 约为 11,726 美元,相当于 58.6 倍。换成更贵的旗舰模型 Fable 5.1,却只剩 2,485 美元,也就是 12.4 倍。同一个套餐能差近 5 倍,因为不同模型和不同类型的 token,扣掉后台额度的速度并不一样。Anthropic 给 Sonnet 和 Opus 留了大量额度,对 Fable 则明显收紧。 国产 Coding Plan 同样大量补贴重度用户,但力度仍追不上 Claude。SemiAnalysis 测得,132 美元的 MiniMax Token Ultra 可折算约 3,088 美元 MiniMax-M3 API 用量,相当于月费的 23.4 倍;168 美元的智谱 GLM Coding Max 约为 11.6 倍;199 美元的 Kimi Code Ultra 约为 6.7 倍。即使是其中最高的 MiniMax,每美元折算价值也只有 Claude Sonnet、Opus 的四成左右。 OpenAI 最近反而开始主动收紧补贴。新购 Pro 200 的各档模型 token 额度被直接减半,此前购买的套餐可暂时保留旧额度到 10 月 29 日。现在 200 美元 ChatGPT Pro 使用 GPT-6.1 Sol,折算价值约 2,084 美元,相当于月费的 10.4 倍;同价 Claude Opus 是它的 5.6 倍。即使撇开两款模型 API 单价的差异,只算实际 token,两者也是约 286 亿对 102 亿,Claude 仍多 2.8 倍。 但到
Antigravity终于上Claude 5.5:仅限付费Pro订阅及Ultra,旧模型11月退场
动察 Beating AI 快讯,Google 的 AI 编程工具 Antigravity 已接入 Claude Opus 5.5 和 Sonnet 5.5。两款模型向 Google AI Ultra 和 Pro 开放,但 Pro 仅限正式订阅,仍处于免费试用期的用户无法使用。Free 和 Google AI Plus 暂时拿不到 5.5。Antigravity 支持为模型选择 Low、Medium、High 三档思考强度。 Google 同时开始清理旧模型。Claude Opus 4.6、Sonnet 4.6 和 GPT-OSS-120b 都将在 11 月 2 日移除。按当前模型表,如果没有新模型补位,Free 和 Google AI Plus 届时将没有 Claude 或 GPT-OSS 可选,只剩 Gemini 系列。 Google 没有公布 Claude 5.5 的具体额度,只说明 Pro 额度每 5 小时刷新,同时受周额度限制。Gemini 与 Claude、GPT 使用两套独立额度。已经有多名 Pro 用户反馈,Opus 5.5 跑一次任务就可能快速消耗五小时和周额度,有用户称运行约 9 分钟就用掉了一半周额度。
MiniMax把OpenAI新Agents API做成开源版,Codex、Claude Code都能接
动察 Beating AI 快讯,MiniMax 开源 OpenAgentCore,做了一套兼容 OpenAI Agents API 的自托管实现。开发者可以继续使用 OpenAI 官方 SDK,只需要换掉 API 地址,后台运行的 Agent 可以选择 Codex、Claude Code 或 MiniMax Code。 Agents API 可以理解成一套「调用 Agent 的统一接口」。普通模型 API 主要负责一问一答。Agent 要连续干几个小时甚至几天,还要管理上下文、调用工具、协调子 Agent、保存任务进度。OpenAI 的 Agents API 把这些能力放到一个长期运行的 Session 里统一管理。 OpenAI 官方版本使用 OpenAI 托管的 Codex 执行框架。开发者可以自己选择代码在哪运行,但 Agent 的任务编排、上下文管理和运行状态仍由 OpenAI 负责。OpenAgentCore 则把这套后端也交给开发者自己部署。
OpenAI重开200美元Pro:价格不变,API等值用量减半
动察 Beating AI 快讯,OpenAI 将重新开放每月 200 美元的 Pro 20x,但套餐用量算法也一起改。Tibo Sottiaux 明确表示,新方案折算成同等 API 花费后,只有旧版约一半。价格没变,最确定的变化就是 API 等值额度缩水。20x 之后到底变成多少,OpenAI 还没公布。 OpenAI 的解释是,Sol 和 Luna 的 API 价格刚降了约 50%,模型也会越来越高效,所以更少的「美元额度」仍可能完成差不多甚至更多工作。这个逻辑在价格同步腰斩的模型上可能成立,但不代表所有模型都能持平。所谓「能做更多工作」,目前也没有新旧套餐的实测数据支撑。 此外,Pro 20x 的用量一直不够透明。过去几周,GitHub 和 OpenAI 社区已经出现大量用户反馈:周额度会突然大幅下降、重置时间变化,或者长上下文和多 Agent 任务消耗远超预期。还有用户称,一次 Astra Ultra 任务 5.2 小时就消耗了约 2.4 个 Pro 20x 周额度。