Pi 1.0发布:长任务另拆Pi Durable,崩溃后还能接着跑
相关推荐
Cloudflare给Coding Agent自动开「临时测试服」
动察 Beating AI 快讯,Cloudflare 上线 Worker Previews。 Worker 可以简单理解成跑在 Cloudflare 上的后端程序,比如处理 API、登录、数据库和网页请求。现在开发者或 Coding Agent 每新建一个 Git 分支,都能给这套程序临时开一个独立测试环境,改完代码直接部署进去试,不用碰正式网站。 这套测试环境有自己的网址、日志和运行状态,Durable Objects、Containers 等资源也能单独创建。Agent 因此可以自己完成改代码、部署、打开网页测试、看报错,再继续修改。 Cloudflare 以前也有 Preview URLs,但主要只是给某个 Worker 版本生成一个临时网址,背后的资源仍可能连着正式环境。现在每个分支都能单独跑一套,Agent 测试新代码时,就不用担心把线上服务一起搞坏。
Amp取消平台门票:自带ChatGPT和电脑就能免费跑Coding Agent
动察 Beating AI 快讯,Amp 推出免费 Hobby 档。Amp 是从 Sourcegraph 拆出来的 Coding Agent 公司,产品和 Claude Code、Codex 属于一类,可以让 AI 自己读代码、改代码、跑命令和测试。现在只要用自己的电脑,再接自己的 ChatGPT 订阅或模型 API Key,就能免费使用 Amp,不再额外交月费和 BYOK Token 费。 今年 7 月 Amp 推出订阅制后,想把自己的 ChatGPT 订阅接进 Amp,至少要开每月 20 美元的 Megawatt。BYOK 即便用的是自己的模型 Key,Amp 也会收额外 Token 费用并设限制。现在这两层都取消了。ChatGPT 订阅费或 API 本身的模型费用,还是用户自己承担。 Amp 还有一个叫 Orb 的远程云电脑产品,可以给每个任务开一套独立环境。代码和开发工具都放在里面,关掉自己的电脑后 Agent 还能继续干活,也方便同时跑多个任务。Orb 依然按使用量收费;不想付这笔钱,也可以让 Amp 直接跑在自己的电脑上。 另外,Amp 还在扩大 BYOK 范围。付费用户已经可以接 OpenRouter、Amazon Bedrock、Azure Foundry、Ollama Cloud 和自定义模型接口等,之后会开放给所有用户。
MiniMax把OpenAI新Agents API做成开源版,Codex、Claude Code都能接
动察 Beating AI 快讯,MiniMax 开源 OpenAgentCore,做了一套兼容 OpenAI Agents API 的自托管实现。开发者可以继续使用 OpenAI 官方 SDK,只需要换掉 API 地址,后台运行的 Agent 可以选择 Codex、Claude Code 或 MiniMax Code。 Agents API 可以理解成一套「调用 Agent 的统一接口」。普通模型 API 主要负责一问一答。Agent 要连续干几个小时甚至几天,还要管理上下文、调用工具、协调子 Agent、保存任务进度。OpenAI 的 Agents API 把这些能力放到一个长期运行的 Session 里统一管理。 OpenAI 官方版本使用 OpenAI 托管的 Codex 执行框架。开发者可以自己选择代码在哪运行,但 Agent 的任务编排、上下文管理和运行状态仍由 OpenAI 负责。OpenAgentCore 则把这套后端也交给开发者自己部署。
Jevgrep让Coding Agent少自己找代码:SWE-bench主模型成本降29%
动察 Beating AI 快讯,开发者 David 基于 Jev 开源了一个专门给 Coding Agent 找代码的研究工具 Jevgrep。 用户只要问一句「登录校验写在哪里」,它就会用 TypeSafe 的决策模型 Jev 逐层搜索代码库,找出相关文件和源码片段,再交给 Claude Code、Codex 等 Agent 继续修改和测试。 它主要解决 Coding Agent 很费 token 的「找代码」环节。Jevgrep 不会先把整个仓库塞给模型,也不是只做一次语义搜索。它会先判断哪些目录值得继续找,再检查相关文件和代码声明,最后返回源码片段、行号和后续阅读线索。仓库还提供了 Skill,让 Agent 知道什么时候调用 `jg` 收集上下文。 最新 SWE-bench 实验用了 10 个 Python 任务。使用 Jevgrep 和不用 Jevgrep 都完成了 8 个,但 GPT-5.6 Sol 的总成本从 7.62 美元降到 5.44 美元,减少 28.63%。作者最初在 X 上写的是 40%,仓库随后更新实验结果,目前已经改成「约 30%」。 不过,这个数字只统计 Sol 的费用,没有把 Jev 算进去。实验日志中能够确认的 Jev 调用费用已经至少有 1.57 美元,部分调用缺少完整计费记录,实际总额未知。此外,这组实验只有 10 个任务,而且每题只跑了一次。
Jev团队公开Coding Agent设计草案:每轮重新决定模型该看什么
动察 Beating AI 快讯,TypeSafe 创始人 Diogo Almeida 公开了一份 Coding Agent 设计草案,希望社区直接拿去实验。他直说团队大概率没时间自己把这些想法都做出来。 这份草案最核心的改动是上下文。现在的 Coding Agent 通常会一直带着之前的聊天、工具结果和代码状态,太长了再压缩或重启。TypeSafe 想让 Agent 每轮重新判断:继续沿用现有缓存,还是重新挑一份更合适的上下文;哪些保留全文,哪些只留摘要,哪些直接丢掉。 Almeida 认为,现有 Agent 不少设计都被 KV Cache 反过来绑住了。比如任务先切给便宜模型,再切回强模型,强模型可能还得重新读一遍长上下文,最后反而更贵;工具定义长期塞在系统提示词里,也会一直占空间。 上下文如果能动态重组,模型路由、Sub-agent、MCP 和 AGENTS.md 也能跟着按需加载。简单任务交给便宜模型,需要哪个工具再加载哪个,子 Agent 只拿和自己任务相关的状态。Almeida 暂时把这套思路叫「Meta-attention」。
Cloudflare重做CLI给AI用:Agent已占48%使用量
动察 Beating AI 快讯,Cloudflare 大幅补全了今年 4 月推出的 `cf` CLI。它从最初只支持少量产品,扩展到 Cloudflare 全部 3000 多个 API 操作,并准备接替现有的 Wrangler。相比之下,Wrangler 目前只有约 280 个命令路径。 `cf` 很多设计都直接面向 Coding Agent。命令结果默认返回 JSON,Claude Code、Codex 等 Agent 可以直接读取。新增的 `cf cli search` 还能让 Agent 用自然语言描述想做的事,再自动找到对应命令,不需要提前知道 Cloudflare 有哪些 API。 Cloudflare 也披露,Agent 已经快占到 Wrangler 使用量的一半。今年 3 月这一比例约为 25%,最近一周升到 48%。Agent 平均使用的不同命令接近人类的两倍,执行 6 个以上命令的可能性接近人类的 4 倍。 配置方式也一起改了。`cf` 改用 TypeScript 格式的 `cloudflare.config.ts`,Agent 可以直接利用类型检查和代码补全发现配置错误。现有项目可以通过 `cf migrate` 迁移,但部分依赖 Wrangler 构建流程的 JavaScript 项目,以及 Rust、Python Workers,目前仍会交给 Wrangler 处理。 Cloudflare 计划在 `cf` 稳定后发布 Wrangler 最后一个主要版本,随后继续维护 18 个月。