小米发布并开源探索性 AI编程助手MiMo Code
相关推荐
Claude Code跑Kimi K3最贵最慢,成本是Hermes Agent近4倍
据动察 Beating 监测,AI Agent 基础设施公司 Composio 扩大测试,把同一款 Kimi K3 接入 6 套 Agent 框架,完成 26 项相同任务。这里比较的是运行框架,底层模型均为 Kimi K3。 Kimi Code 完成 21 项排名第一。Hermes 完成 20 项,Pi Agent 和 Claude Code 均为 19 项,OpenCode 为 18 项,Codex 以 17 项垫底。 按 Kimi K3 官方价格估算,Hermes 和 Pi Agent 平均每项任务成本最低,分别为 0.39 美元和 0.40 美元。Claude Code 达到 1.47 美元,约为 Hermes 的 3.8 倍。 Pi Agent 速度最快,单项任务中位耗时为 161.7 秒。Claude Code 最慢,达到 347.6 秒。同一模型换套框架,成功数最多只差 4 项,平均成本却相差近 4 倍,耗时相差超过 2 倍。
传原阿里千问Code负责人加入国内某大厂负责AI Coding
据动察 Beating 监测,多名知情人士称,原阿里通义 Qwen Code 负责人惠彬原已加入一家国内互联网大厂,担任 AI Coding 算法负责人。具体公司尚未披露。 惠彬原于 2026 年 1 月离开阿里。此前《晚点》报道称他加入 Meta,多家媒体随后沿用了这一说法。 惠彬原是 Qwen-Coder 系列核心成员,长期负责代码大模型和 Coding Agent 方向。他近期仍参与软件工程智能体研究,但公开主页尚未显示新雇主。
Codex多Agent补上Luna:Sol当主管,便宜模型批量干活
据动察 Beating 监测,OpenAI 给 Codex 的多 Agent 功能补上了一个实用能力:Sol 现在可以直接把任务派给 Luna。 比如让能力最强的 Sol 负责拆任务和最后检查,再让多个更快、更便宜的 Luna 并行干活。 此前 Codex 已经支持一个 Agent 调用多个子 Agent,也能让不同模型分工。但 Luna 有特殊限制,只能自己执行任务,不能被 Sol 这类上层 Agent 直接拉进团队。这次 OpenAI 把这个限制解除了。 OpenAI 现在也明确推荐这种分工。Sol 适合复杂、开放式任务,Luna 则适合搜索、整理、提取、分类等明确又重复的工作。一个负责动脑和验收,一群负责批量执行。
MiniMax Code从桌面走进终端,CLI版本即将上线
据动察 Beating 监测,MiniMax Code 研发负责人何涛预告,MiniMax Code 即将推出终端版。从晒出的测试界面看,它已经是完整的 Coding Agent 形态,可以在终端里理解任务、思考并执行操作。 MiniMax Code 本身并不是新产品。MiniMax 此前已经有 Web 和桌面版,今年 5 月底正式把桌面 App 改名为 MiniMax Code;6 月发布 M3 时,又把它定位为专门配合自家模型使用的 Agent 产品。官方称其底层 harness 基于 OpenCode 和 Pi。
DeepSeek便宜到离谱:OpenCode两个月狂跑90万亿Token,账单仅92万美元
据 动察 Beating 监测,AI 编程工具 OpenCode 数据显示,6 月 10 日至 8 月 4 日,DeepSeek V4 Flash 在 OpenCode Go 上累计处理 90 万亿个 Token,总支出约 91.7 万美元。平均每 1 亿 Token 只需约 1.02 美元。 低成本主要来自缓存。该模型 96% 的输入 Token 命中缓存,平均每次会话处理 870 万个 Token,成本仅约 0.09 美元。
DeepSeek V4Flash在OpenCode爆量:单日跑掉8万亿Token
据动察 Beating 监测,AI 编程工具 OpenCode 披露,接入 DeepSeek V4 Flash 当天,OpenCode 用户跑了 8 万亿个 Token,其中 5 万亿来自免费计划,3 万亿来自付费订阅 OpenCode Go。 过去一周,它已占 OpenCode 全部 Token 用量的 55%,排名第一。