Claude给Codex查出「失忆」Bug:干了两天的活,重开只记得第一句话
相关推荐
LoopX升到1.0:一个页面管Codex、Claude Code等Agent长任务
动察 Beating AI 快讯,开源项目 LoopX 发布 1.0。它装在 Codex、Claude Code、Cursor 等 Agent 上层,把原本分散在不同会话里的长期任务统一收进一个工作台。 用户可以在一个页面看到所有已接入 LoopX 的任务。哪些正在执行、哪些等你确认、哪些在持续监控、哪些已经排期,都会集中显示。进入单个项目后,还能继续查看不同 Agent 的待办、完成记录、文件和运行状态。 这个工作台可以直接在浏览器打开,也提供 macOS 和 Windows 桌面版。两种入口共用同一套本地服务和任务状态。它不会自动读取电脑上所有 Agent,会显示的是已经注册并接入 LoopX 的 Agent 和任务。 多个 Agent 也可以一起完成同一个目标。它们能分别认领任务、并行工作和相互接力。比如一个 Agent 做完后留下后续任务,下一个 Agent 再接着做。这里的协作靠共享任务和状态完成,并不是让多个 Agent 在一个聊天室里自由对话。
Codex修掉8个吃额度Bug:同样额度多用10%-50%,用户迎来两天两次重置
动察 Beating AI 快讯,OpenAI 修掉了 Codex 里 8 类会额外消耗使用额度的问题,并给所有 Codex 和 ChatGPT Work 付费用户重置额度。Tibo 称,按不同使用方式,相同额度现在预计能多撑 10%-50%。 其中最浪费 Token 的是 `/goal`。部分任务明明已经完成,却没有正常停下,单次可能吃掉 15%-70% 的周额度。Computer History 重复总结历史操作,部分情况下也能消耗约 20% 的周额度。图片压缩、后台记忆、自动任务、子 Agent 和 MCP 等也发现了额外消耗问题。 而且对用户来说,周末的好消息可能还没完。昨天 Tibo 曾预告 Codex 即将达到新的用户里程碑,并暗示会庆祝。今天修 Bug 已经提前重置了一次额度后,他又表示:「今天按钮已经按过了,所以庆祝改到明天。」此前 Codex 达到 15M、20M 等用户里程碑时都送过重置,因此明天很可能还有一次。
Warp把Claude Code、Codex接成自动流水线
动察 Beating AI 快讯,AI 终端工具 Warp 推出 Factories,可以把 Claude Code、Codex、Warp Agent 等 Coding Agent 串起来自动干活。先把流程设好,一个 Bug 进来后,Agent 就能接着查问题、改代码、跑测试,最后提交 PR。 现在 Coding Agent 越来越多,怎么分任务、检查结果、控制成本就越麻烦。Factories 就是把这些事放到一个地方统一处理。 类似的产品最近已经越来越多。Spotify 的 Xirp 可以同时管理多个 Coding Agent,Databricks 的 Omnigent 也在管权限、成本和运行环境。Warp Factories 更强调把整个开发流程自动跑起来。 本质上,大家现在抢的不只有「谁的 Coding Agent 更强」,也包括「谁来管这些 Agent」。后者甚至可能更重要。
传豆包2.2延期:字节补课Coding,招聘直接点名Claude Code、Codex
动察 Beating AI 快讯,字节原计划 8 月发布的豆包 2.2 推迟了。字节准备多花一些时间训练,重点补 Coding、工具调用和 Agent。 字节今年给 Seed 定的目标之一,就是把 Coding 做到第一梯队。内部希望年底前能做出类似 GLM-5.2、Kimi-K3 那种效果,让开发者真正开始认可字节的 Coding 模型。 8 月,Seed 刚做完一次大调整。原本按文本、语音、代码、视觉划分的团队被重新拆开,变成 Pretrain Data、Horizon RL、Product Posttrain-Work 和 Product Posttrain-Chat 四个部门。Horizon RL 会负责 Coding 后训练,Work 团队则重点做工具调用、GUI 操作和长任务执行。 字节最近也在密集招这方面的人。官网正在招 Code Agent、通用 Agent 和强化学习算法工程师。一份 Multi-Agent Harness 岗位甚至直接写明,要研究 Claude Code、Codex 等 Coding Agent,还要搭建能连续跑很久的多 Agent 和强化学习环境。 Seed 2.1 在 6 月发布时就已经重点强调 Coding,但字节显然觉得还不够。豆包 2.2 这次宁愿晚一点,也想先把 Coding 补得更像样。
Lody开源:手机上也能同时指挥Claude Code、Codex
动察 Beating AI 快讯,Lody 宣布开源 CLI 和本地桌面端,采用 Apache 2.0 许可。它不是新的 Coding Agent,而是给现有 Agent 套一层共享工作区。Claude Code、Codex、Kimi、OpenCode 等都能接进来。团队可以共享会话、看运行状态和代码改动,也能从手机或网页把任务派到电脑、服务器上。 多 Agent 同时干活时,不同会话可以放进独立 Git worktree,避免几路 Agent 同时改代码互相冲突。Agent 之间还能创建、读取和继续其他会话。一个主 Agent 可以把排查、实现、测试拆给多个子会话并行跑。 不过这次不是整套 Lody 全开源。公开仓库明确排除了托管后端、部署配置、计费系统,以及 Web 和手机 App 源码。跨设备协作目前仍依赖 Lody 的托管同步服务,也还不支持端到端加密。官方下一步想继续往 local-first 走,让会话、文档、任务和历史决策逐渐变成团队自己掌控的项目上下文。
Claude Code官方省Token指南:11个技巧让额度用得更久
据动察 Beating 监测,Anthropic 发布 Claude Code 省 Token 指南。核心就一句:上下文越长,后面每一轮越贵。聊天、文件和命令输出都会继续占用 Token,也会因此更快消耗额度。 整理下来,有 11 个最实用的技巧: 1. 换任务就 /clear。一个任务做完就清掉上下文。还在做同一个任务,只是前面的内容没用了,再用 /compact 压缩。长会话越往后越贵,因为每一轮都会重新带上之前的内容。 2. 模型和 effort 开局就选好。中途执行 /model 或 /effort 会打掉 prompt cache(提示词缓存),下一轮需要重新处理整段上下文。Fast mode 也是一样,最好一开始就开。 3. 离开前先 /compact。订阅用户的缓存约 1 小时过期,API Key 默认约 5 分钟。缓存过期后再回来,下一轮通常要重新处理整个上下文。趁缓存还在时压缩更便宜。 4. 最近几轮跑偏就 /rewind。它只删掉后面几轮,前面的缓存还能继续用。/compact 会重写整个对话,成本更高。 5. 文件直接用 @ 文件名。Claude 会在第一轮直接拿到文件,可以省掉一次 Read 或搜索。一个文件通常只需要 @ 一次,重复 @ 反而可能把同一文件再塞一份进上下文。 6. Prompt 尽量说具体。与其说「测试挂了」,不如直接告诉 Claude 哪个测试、哪个文件。否则它可能先 grep、搜索、读一堆文件,这些结果之后每一轮都会继续占上下文。 7. 测试和日志尽量少输出。Build、测试、git log 的输出都会留在上下文。可以加 quiet 参数、只输出错误,或者用 tail 截断。Claude Code 对超过 3 万字符的命令输出反而会自动写入文件,只把摘要和路径留在会话里。 8. 用 /context 查启动负担。新会话一开始就可以看 CLAUDE.md、MCP 和工具定义占了多少上下文。CLAUDE.md 只放通用规则,专项流程放进按需加载的 Skill,不用的 MCP 用 /mcp 关掉。 9. 简单任务用更小的模型、更低的 effort。大模型输入和输出都更贵,thinking 也属于输出 Token。纯执行类任务没必要一直用最高档模型和最高推理强度。 10. 大日志交给 subagent,小任务别滥用。Subagent 有独立上下文,只把最终结果带回主会话,适合读大量日志、搜索文档。但它也要重新读文件、自己跑多轮,小任务反而可能更贵。搜索、读日志这类任务还可以指定 Haiku 或 Sonnet。 11. /loop 最好单独开会话。每次循环都是完整的一轮,会重复携带当前会话的全部上下文。如果间隔超过缓存时间,还可能叠加一次缓存失效。官方建议另开终端,用一个干净会话专门跑循环。 Anthropic 的建议归根结底就是:少塞无用内容,任务结束及时清,会话别拖得太长。