Pokee发布1000万Token模型,上下文接近主流模型10倍
相关推荐
MetaMask推出自托管AI钱包Agent Wallet,支持AI代理自主执行链上交易
PANews 8月7日消息,据Decrypt报道,加密钱包服务商MetaMask宣布推出“Agent Wallet”自托管AI钱包,允许AI代理(AI Agent)在用户设定的权限范围内自主执行链上交易,进一步布局AI驱动的加密交易基础设施。 MetaMask表示,Agent Wallet面向使用AI代理进行市场监控、机会识别和自动交易的交易者与开发者。
OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API
据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。
Pi重构Agent执行层:长任务开始走向持久化运行
据动察 Beating 监测,Pi 正在重做 Agent Harness。最新 Harness v3 规范已经写完,正在做最终审计。它重做了任务执行和存储,让 Agent 即使跑到一半进程崩溃,甚至 Harness 自己升级,也能从中断处继续。 Pi 是 Mario Zechner 创建的开源 Agent Harness,最早因为 OpenClaw 使用它而出圈。项目今年被 Earendil 收购,Mario 也加入公司继续负责开发。现在 Pi 已有超过 6 万 GitHub Star,MiniMax 最新的 MiniMax Code 也明确基于 OpenCode 和 Pi 搭建 Harness。 v3 这次直接重做了底层架构。模型请求和工具调用前都会先保存执行状态,完成后再写入结果。重启后,Pi 能知道哪些已经做完、哪些可以重跑、哪些有副作用不能再执行一次。对话、运行状态和 Token 成本也改成分开保存,并加入跨版本状态迁移。 Claude Code、Codex 都在把 Agent 往更长的任务推。OpenAI 已经专门研究怎么让 Codex 持续完成长时间工作,Anthropic 也称 Claude Code 正越来越多地被用于长时间运行的 Agent 任务。Agent 能连续干几小时以后,前面几小时就不能因为一次崩溃全部白干。
蚂蚁开源Ling-3.0-tiny:79亿参数,M4Pro本地跑到90Token/s
据动察 Beating 监测,蚂蚁百灵正式开放 Ling-3.0-tiny 权重,提供 BF16、FP8 和 INT4 三个版本,Hugging Face 页面标注为 MIT 许可。模型共有 79 亿参数,每个 Token 只激活 13 亿,主要面向本地部署和 Agent 场景。 Ling-3.0-tiny 有 128 个路由专家,每个 Token 只选择其中 8 个,再加 1 个所有 Token 都会使用的共享专家。注意力部分采用 3:1 的 KDA 与 MLA 混合架构,也就是每 3 层 Kimi Delta Attention 后接 1 层 MLA。 官方称 FP8 版在 M4 Pro MacBook 上可达到约 86–90 Token/s;DGX Spark 上约为 100–105 Token/s。
Meta确认将推Harness工具,开源模型也在路上
据动察 Beating 监测,Meta 首席 AI 官 Alexandr Wang 在 YC Startup School 2026 表示,公司将推出自家 Harness 工具,并继续发布开源模型。 Harness 是包在模型外面的 Agent 运行框架,比如 Claude Code。它负责调用工具、读写文件和管理上下文,让模型连续完成复杂任务。 Meta 今年 4 月就已计划开源部分新模型。
Meta高管:工程师AI账单或追平工资,未来可能限额
据动察 Beating 监测,Instagram 负责人 Adam Mosseri 表示,未来一两年,能力较强的工程师消耗的 AI Token 成本,可能接近其工资或整体雇佣成本。 届时,Meta 可能为每名工程师设置 Token 上限。额度将取决于公司是否相信这笔钱能带来正向回报。 Meta 目前尚未设限。公司此前已关闭内部 Token 消耗排行榜。 Mosseri 称,这类排行榜只会鼓励员工「烧 Token」,却不一定创造价值。企业对 AI 的态度正从鼓励多用,转向计算投入产出。