Breez:AI 编码代理推动比特币集成需求激增约 14 倍
相关推荐
Anthropic给Claude Code用户送云端额度:Pro100美元,Max250美元
动察 Beating AI 快讯,Anthropic 宣布 Claude Code Cloud Sessions 从研究预览转为正式可用。它会把 Claude Code 跑在 Anthropic 的云端环境里,电脑关掉后任务也能继续。用户可以从网页、手机、桌面端或 CLI 启动。 现有 Pro 和 Max 用户还能领取一次性专用额度,Pro 为 100 美元,Max 为 250 美元。这笔额度只用于 Cloud Sessions,与平时的订阅使用上限分开。即使本地 Claude Code 已经触发使用限制,云端任务仍能继续跑,直到这笔额度用完。领取截止到 10 月 7 日,额度在 11 月 4 日过期。 这不是把原来的云端功能改成单独收费。Anthropic 当前文档明确写着,Cloud Sessions 平时仍与 Claude 和 Claude Code 共享订阅使用限额,也没有额外的云端 VM 费用。赠送额度用完后,就重新按正常订阅限额使用。
佛罗里达女子用 Claude 写日记,Anthropic 审查后报警
ChainCatcher 消息,据 Decrypt 报道,美国佛罗里达州 Bonita Springs 女子 Carli Michelle Heller 因将 Claude 当作日记使用而被捕。调查人员称,她在 9 月 26 日写下将“扫射”李县警长办公室的内容,次日又表示自己获得了新枪。Anthropic 的安全系统标记了这些对话,因内容严重,平台交由人工审查团队处理,后者向执法部门报告。警员据此锁定 Heller,前往其住所并将其拘留,她被控以书面形式发出暴力威胁,案件定于 11 月开庭。Anthropic 的消费者条款明确保留“自行决定”将用户输入、输出或行为报告给执法部门的权利。其 2026 年 9 月 10 日生效的隐私政策也允许公司在善意相信披露为预防严重伤害所合理必要时与警方共享数据。即便用户选择不将数据用于模型训练,Anthropic 仍可在三个月内使用其数据,而非五年;被标记送审的对话还会用于改进有害内容检测能力。这并非首例。《旧金山标准报》9 月报道,Anthropic 曾将一名用户移交警方,该用户据称写道自己购买了 AR-15 步枪,并将公司 CEO Dario Amodei 置于瞄准镜中,其称只是开玩笑,报道刊发时未被逮捕或起诉,Anthropic 发言人称此事是“我们的防护流程按预期运作”。
Claude Code开始拆自己:Function Hooks正式上线为Mods
动察 Beating AI 快讯,Anthropic 正式上线 Claude Code Mods。它就是此前预览的 Function Hooks,正式产品名现在定为 Mods。底层仍使用 Function Hooks,一个 Mod 本质上就是能直接修改 Claude Code 的插件。 Mods 可以改 Claude Code 的行为和界面。它能在 prompt 发给模型前改写内容,也能拦截、修改或重试工具调用,处理权限请求,甚至替换部分界面。用户还可以直接让 Claude 写 Mod、安装并立即加载。 Anthropic 也开始把 Claude Code 自带功能拆成 Mods。/diff 已经率先迁移,用户可以关闭它,也可以换成自己的版本。官方计划继续迁移更多内置功能,让 Claude Code 最后只保留一个更小的核心。Mods 仍通过现有 Plugin 安装和分享,CLI 和桌面端都能使用。 不过,Mods 没有沙箱隔离,拥有和 Claude Code 本身相同的本机权限。Anthropic 建议只安装可信来源的 Mod。
MiniMax把OpenAI新Agents API做成开源版,Codex、Claude Code都能接
动察 Beating AI 快讯,MiniMax 开源 OpenAgentCore,做了一套兼容 OpenAI Agents API 的自托管实现。开发者可以继续使用 OpenAI 官方 SDK,只需要换掉 API 地址,后台运行的 Agent 可以选择 Codex、Claude Code 或 MiniMax Code。 Agents API 可以理解成一套「调用 Agent 的统一接口」。普通模型 API 主要负责一问一答。Agent 要连续干几个小时甚至几天,还要管理上下文、调用工具、协调子 Agent、保存任务进度。OpenAI 的 Agents API 把这些能力放到一个长期运行的 Session 里统一管理。 OpenAI 官方版本使用 OpenAI 托管的 Codex 执行框架。开发者可以自己选择代码在哪运行,但 Agent 的任务编排、上下文管理和运行状态仍由 OpenAI 负责。OpenAgentCore 则把这套后端也交给开发者自己部署。
Claude Code自己给AI应用调优:改Prompt、换模型,变差就回滚
动察 Beating AI 快讯,Anthropic 给 Claude Code 的官方 claude-api Skill 加了一套自动调优工作流。build-eval 先从真实对话、Bug 或人工案例里做出测试集和评分方法,hillclimb 再让 Claude Code 反复修改系统 Prompt、工具说明、模型和推理强度。每次改完都重新跑测试,效果变好就保留,变差就回滚。 为了避免 Claude 只针对测试题优化,它不会拿所有样本一起调。部分案例用于找问题和改配置,另留一批案例检查修改能不能用在没见过的问题上。如果前面的分数涨了,留出的测试结果没有改善,这次修改就可能被判定为过拟合并撤回。 Anthropic 用 44 条客服工单演示了这套流程。Claude Code 先后清理 Prompt、补充业务规则、尝试不同模型并降低推理强度。最终找到一套 Sonnet 5 低 effort 配置。在 14 条没有参与调优的工单上,准确率从初始配置的 78.6% 提到 90.5%,成本降到约原来的五分之一。
Anthropic 发布 Claude Sonnet 5.5,编程成绩超过 Opus 5.5
ChainCatcher 消息,Anthropic 于本周一发布 Claude Sonnet 5.5,作为今年 6 月推出的 Sonnet 5 的升级版本。官方称该中端模型运行速度较上一代提升超过 30%,在范围明确的日常任务、修复缺陷以及制作文档、幻灯片和表格方面表现最强,同时具备敏锐的设计能力。其定价维持每百万输入 token 2 美元、每百万输出 token 10 美元,为 Opus 5.5 的一半,且每个任务消耗的 token 较 Sonnet 5 减少近三分之一。在 Terminal-Bench 4 测试中,Sonnet 5.5 得分 70.6%,高于 Opus 5.5 的 66.4%,Sonnet 5 仅为 10.3%。独立测试机构 Artificial Analysis 的结果同样显示其领先,分别录得 63.6% 与 59.6%,OpenAI 的 GPT-6 Astra 为 59.1%。在评估 44 类职业真实工作表现的 GDPval-AA 上,Sonnet 5.5 获 1844 分,与 Opus 5.5 的 1846 分基本持平,GPT-6 Sol 为 1487 分。