韩国多家金融机构疑遭AI攻击,黑客在Claude Code留下身份线索
相关推荐
阶跃星辰开源Step Code:自测追平DeepSeek Harness,token更省
动察 Beating AI 快讯,阶跃星辰开源 AI 编程工具 Step Code v0.1.0,采用 MIT 许可证。它直接跑在终端里,可以读写代码、跑测试和执行开发任务,还支持 MCP、Agent Skills 和 Claude Code 插件。内置的 StepPage 可以一条命令把本地静态网站发布到线上。 Step Code 主打少用 token。在阶跃自己的 Terminal-Bench 2.1 横评中,它完成 72/89 个任务,得分 80.9%,与 DeepSeek Harness 并列最高,但 token 用量更低。 阶跃自建的 Multi-Frame 长任务测试共有 150 道题,Step Code 完成 110 道,得分 73.3%,平均每题消耗 509 万 token,在对比的 6 款 harness 中同时拿到最高通过率和最低 token 用量。 不过阶跃没有公布这轮横评具体用了哪个底层模型,也没有拆解这些 token 是怎么省下来的。官方只提到 Step Code 与 Step 系列模型一起针对 token 消耗做过调优。 源码里也能看到不少「节流」设计:文件读取和命令输出会限长,搜索尽量缩小返回范围,长对话默认会压缩上下文,system prompt 也要求能直接调用工具就不要额外开 Agent。 还有一套更激进的 contextProjection,可以裁掉旧工具输出、重复结果和历史 reasoning,不过默认关闭。 综合来看,它的 token 优势来自模型和 harness 多处优化叠加。
Codex写了130万行没搞定,Claude两周移植TypeScript编译器
动察 Beating AI 快讯,知名开发者 Theo 开源了 tsc-rs。他让 AI 将微软用 Go 编写的 TypeScript 7 编译器移植到 Rust,覆盖编译器、类型检查器和语言服务器,目标是直接替代官方的 tsc。Theo 称,自己从头到尾没有读过一行生成的代码。 这个项目持续了约五个月。Theo 最初使用 Codex 等工具,调用多款 OpenAI 模型,生成超过 130 万行 Rust 代码,但兼容性始终没能突破约 84%。按 API 标价折算,消耗的 Token 价值超过 40 万美元。 后来他换用 Claude Opus 5.5。模型直接放弃之前的代码,从头重新移植。10 小时做出可运行的初版,两周内完成主要工作,Token 消耗按 API 价格折算约 2.4 万美元。 测试显示,tsc-rs 已通过 181,711 项从 Go 移植的测试。在 120 个开源项目中,检查结果与微软 Go 版基本一致,仅存在少量已知行为差异。另据 60 个开源项目的性能测试,Rust 版的类型检查平均耗时约为 Go 版的一半。
Claude Code开始拆自己:Function Hooks正式上线为Mods
动察 Beating AI 快讯,Anthropic 正式上线 Claude Code Mods。它就是此前预览的 Function Hooks,正式产品名现在定为 Mods。底层仍使用 Function Hooks,一个 Mod 本质上就是能直接修改 Claude Code 的插件。 Mods 可以改 Claude Code 的行为和界面。它能在 prompt 发给模型前改写内容,也能拦截、修改或重试工具调用,处理权限请求,甚至替换部分界面。用户还可以直接让 Claude 写 Mod、安装并立即加载。 Anthropic 也开始把 Claude Code 自带功能拆成 Mods。/diff 已经率先迁移,用户可以关闭它,也可以换成自己的版本。官方计划继续迁移更多内置功能,让 Claude Code 最后只保留一个更小的核心。Mods 仍通过现有 Plugin 安装和分享,CLI 和桌面端都能使用。 不过,Mods 没有沙箱隔离,拥有和 Claude Code 本身相同的本机权限。Anthropic 建议只安装可信来源的 Mod。
MiniMax把OpenAI新Agents API做成开源版,Codex、Claude Code都能接
动察 Beating AI 快讯,MiniMax 开源 OpenAgentCore,做了一套兼容 OpenAI Agents API 的自托管实现。开发者可以继续使用 OpenAI 官方 SDK,只需要换掉 API 地址,后台运行的 Agent 可以选择 Codex、Claude Code 或 MiniMax Code。 Agents API 可以理解成一套「调用 Agent 的统一接口」。普通模型 API 主要负责一问一答。Agent 要连续干几个小时甚至几天,还要管理上下文、调用工具、协调子 Agent、保存任务进度。OpenAI 的 Agents API 把这些能力放到一个长期运行的 Session 里统一管理。 OpenAI 官方版本使用 OpenAI 托管的 Codex 执行框架。开发者可以自己选择代码在哪运行,但 Agent 的任务编排、上下文管理和运行状态仍由 OpenAI 负责。OpenAgentCore 则把这套后端也交给开发者自己部署。
Claude Code自己给AI应用调优:改Prompt、换模型,变差就回滚
动察 Beating AI 快讯,Anthropic 给 Claude Code 的官方 claude-api Skill 加了一套自动调优工作流。build-eval 先从真实对话、Bug 或人工案例里做出测试集和评分方法,hillclimb 再让 Claude Code 反复修改系统 Prompt、工具说明、模型和推理强度。每次改完都重新跑测试,效果变好就保留,变差就回滚。 为了避免 Claude 只针对测试题优化,它不会拿所有样本一起调。部分案例用于找问题和改配置,另留一批案例检查修改能不能用在没见过的问题上。如果前面的分数涨了,留出的测试结果没有改善,这次修改就可能被判定为过拟合并撤回。 Anthropic 用 44 条客服工单演示了这套流程。Claude Code 先后清理 Prompt、补充业务规则、尝试不同模型并降低推理强度。最终找到一套 Sonnet 5 低 effort 配置。在 14 条没有参与调优的工单上,准确率从初始配置的 78.6% 提到 90.5%,成本降到约原来的五分之一。
Anthropic给Claude Code用户送云端额度:Pro100美元,Max250美元
动察 Beating AI 快讯,Anthropic 宣布 Claude Code Cloud Sessions 从研究预览转为正式可用。它会把 Claude Code 跑在 Anthropic 的云端环境里,电脑关掉后任务也能继续。用户可以从网页、手机、桌面端或 CLI 启动。 现有 Pro 和 Max 用户还能领取一次性专用额度,Pro 为 100 美元,Max 为 250 美元。这笔额度只用于 Cloud Sessions,与平时的订阅使用上限分开。即使本地 Claude Code 已经触发使用限制,云端任务仍能继续跑,直到这笔额度用完。领取截止到 10 月 7 日,额度在 11 月 4 日过期。 这不是把原来的云端功能改成单独收费。Anthropic 当前文档明确写着,Cloud Sessions 平时仍与 Claude 和 Claude Code 共享订阅使用限额,也没有额外的云端 VM 费用。赠送额度用完后,就重新按正常订阅限额使用。