返回 7*24 快讯
来源PANews

AI Agent消耗的Token量接近人类用户的5倍,自今年2月以来增长14倍

PANews 8月24日消息,据 a16z 统计,AI Agent 对 token 的消耗量自 2 月以来增长了 14 倍,已远超人类用户,几乎是人类的 5 倍。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-11 11:01

英伟达给Pi加外挂:Agent自己研究找出4种优化,Token最高省64%

动察 Beating AI 快讯,英伟达 NVLabs 开源 SoL-Pi,给 Coding Agent Harness「Pi」加了一层效率优化。研究团队搭了一套自动研究流程,让多个 Agent 分析 Pi 的运行轨迹、提出优化方案、改代码并自动验证。最初有 152 个候选方向,最后只留下 4 个。 这 4 个优化都在减少重复开销。比如改完代码后直接接着跑测试,少一次模型调用;读过的大文件和长输出先存到本地,需要时再取;子任务结束后判断要不要压缩上下文;超长日志先交给便宜模型筛重点,再核对内容确实来自原日志。 在 EdgeBench 上,SoL-Pi 相比原版 Pi 少用 45%–49% Token,成本低约三分之一;相比 Codex、Claude Code 的原生 Harness,Token 少 35%–64%,按 API 标价计算成本低 50%–54%。 不过省钱会损失一点能力,SoL-Pi 保留了 Pi 约 94% 的平均得分;在 Terminal-Bench 4 的 63 个 CPU 任务里,它解出 15 个,Codex 和 Pi 都是 18 个。

09-11 06:28

阿里云:Token Plan个人版升级,新增12类Agent Harness工具

火星财经消息 9月11日,阿里云Token Plan个人版升级。据介绍,原有价格及Credit额度保持不变,Standard和Pro套餐新增Agent Harness工具权益与用量,覆盖搜索、网页解析、图像生成、语音处理、代码执行等12项Agent开发常用能力。(广角观察)

09-01 09:51

Qwen27B改成扩散Agent:速度拉到500+Token/s,厂商自测单项超Sol

动察 Beating AI 快讯,专攻超高速大模型的 Celeris 发布一款基于 Qwen3.8-27B 改出来的混合扩散 Agent 模型 Celeris-1 Magnus,官方称在不少场景能跑到 500+ Token/s。 在 τ³-Banking 的 97 个银行客服任务上,Magnus 开启 low reasoning 后完成率达到 41.2%,中位耗时 55 秒。同场的 GPT-5.6 Sol 是 38.1%、79 秒。 传统模型基本一个 Token 一个 Token 往后写,Magnus 能一次生成多个 Token,再反复修正。需要严格按顺序生成的内容再串行处理,因此一次计算可以往前推进更多 Token。

08-27 09:59

海光信息发布“Agent to Token开放计算架构”

火星财经消息,在2026中国国际大数据产业博览会上,海光信息首发“Agent to Token开放计算架构”,依托CPU与DCU双芯协同及开放互连,为Agent任务执行与词元生产全周期提供系统级计算支撑。在此次数博会上,海光信息牵头成立的围绕国产通用计算平台的产业生态系统联合体光合组织多家成员单位同步亮相。

09-12 01:11

Token Terminal:链上代币化资产规模达3461亿美元,其中股票规模约为24亿美元

PANews 9月12日消息,据 Token Terminal 数据,链上代币化资产市场规模达 3461 亿美元,其中美元稳定币规模约为 2,985 亿美元,占比 86.2%;美国国债、收益策略、信贷基金和黄金分别为 150 亿美元、105 亿美元、64 亿美元和 51 亿美元,占比分别为 4.3%、3.0%、1.8% 和 1.5%。此外,代币化股票规模约为 24 亿美元,占比 0.7%。

09-11 10:20

腾讯T1专攻Agent长任务:连续操作300多轮,跑分涨20分

动察 Beating AI 快讯,腾讯把 Qwen3.5-122B-A10B 专门拿去练终端 Agent,做出了 T1。它主要处理 Linux 终端里的复杂任务,单个任务最多能连续调用工具 300 多轮。Terminal-Bench 2.1 得分从底模的 43.8% 升到 64.0%,涨了 20.2 分。 这 20.2 分里,大头来自强化学习。SFT 只把分数拉到 49.4%,后面的强化学习又涨了 14.6 分。团队准备了约 1.5 万个终端任务,每个任务都配有自动测试。Agent 没把整个任务做完,只要完成了其中一些要求,也能拿到相应奖励。 长任务还有一个麻烦。Agent 真正干活和之后拿这段经历训练时,同一句内容可能被重新切成不同 token,MoE 也可能换一批专家处理。T1 会把当时生成的 token 和选中的专家都记下来,训练时直接照着重放,把这种训推偏差压低了约三分之一。