返回 7*24 快讯
来源MarsBit

传原阿里千问Code负责人加入国内某大厂负责AI Coding

据动察 Beating 监测,多名知情人士称,原阿里通义 Qwen Code 负责人惠彬原已加入一家国内互联网大厂,担任 AI Coding 算法负责人。具体公司尚未披露。 惠彬原于 2026 年 1 月离开阿里。此前《晚点》报道称他加入 Meta,多家媒体随后沿用了这一说法。 惠彬原是 Qwen-Coder 系列核心成员,长期负责代码大模型和 Coding Agent 方向。他近期仍参与软件工程智能体研究,但公开主页尚未显示新雇主。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-16 14:40

Codex多Agent补上Luna:Sol当主管,便宜模型批量干活

据动察 Beating 监测,OpenAI 给 Codex 的多 Agent 功能补上了一个实用能力:Sol 现在可以直接把任务派给 Luna。 比如让能力最强的 Sol 负责拆任务和最后检查,再让多个更快、更便宜的 Luna 并行干活。 此前 Codex 已经支持一个 Agent 调用多个子 Agent,也能让不同模型分工。但 Luna 有特殊限制,只能自己执行任务,不能被 Sol 这类上层 Agent 直接拉进团队。这次 OpenAI 把这个限制解除了。 OpenAI 现在也明确推荐这种分工。Sol 适合复杂、开放式任务,Luna 则适合搜索、整理、提取、分类等明确又重复的工作。一个负责动脑和验收,一群负责批量执行。

08-01 14:54

Claude Code跑Kimi K3最贵最慢,成本是Hermes Agent近4倍

据动察 Beating 监测,AI Agent 基础设施公司 Composio 扩大测试,把同一款 Kimi K3 接入 6 套 Agent 框架,完成 26 项相同任务。这里比较的是运行框架,底层模型均为 Kimi K3。 Kimi Code 完成 21 项排名第一。Hermes 完成 20 项,Pi Agent 和 Claude Code 均为 19 项,OpenCode 为 18 项,Codex 以 17 项垫底。 按 Kimi K3 官方价格估算,Hermes 和 Pi Agent 平均每项任务成本最低,分别为 0.39 美元和 0.40 美元。Claude Code 达到 1.47 美元,约为 Hermes 的 3.8 倍。 Pi Agent 速度最快,单项任务中位耗时为 161.7 秒。Claude Code 最慢,达到 347.6 秒。同一模型换套框架,成功数最多只差 4 项,平均成本却相差近 4 倍,耗时相差超过 2 倍。

07-29 18:04

阿里Qoder开源AI编程体检工具,Claude Code和Codex也能用

据动察 Beating 监测,阿里云旗下 AI 编程工具 Qoder 开源 Better Harness,并采用 MIT 许可证。它会检查一个代码项目有没有给 Coding Agent 准备好规则、工具和验证流程。 检查范围包括代码仓库、Agent 配置和真实任务记录。它会看项目能否正常启动,测试命令是否清楚,Agent 有没有权限限制,改完代码后是否真的跑了相关测试。 检查结束后,它会列出 Agent 容易出错的环节。每个问题都有证据、影响、修复范围和复验方法。用户可以直接让 Agent 修改,再重新检查。 Better Harness 已支持 Qoder、Claude Code、Codex、Cursor 和 Qwen Code。各平台能力还没有完全拉齐,Qoder 当前最完整。 Qoder 还用它检查了 Better Harness 自己的代码仓库,最终得到 58 分。这也说明它仍处于早期阶段,开源后还在快速修补问题。

08-13 20:52

DeepSeek Harness正式上线:首款Agent产品,整个Agent可实现自行组装

据 动察 Beating 监测,DeepSeek 正式上线首款 Agent 产品 DeepSeek Harness,软件包已经发布至 npm。此前 V4-Flash 的公开 Code Agent 评测,用的就是 Harness 内置的极简模式。 它不只是一款类似 Codex 的 Coding Agent。Harness 支持管理项目、长任务、多 Agent、Skill、联网搜索和上下文管理,还允许用户创建不同的「Agent 预设」。写代码、研究、写作等任务,可以配置不同的工具、提示词和工作方式。 更特别的是插件系统。DeepSeek 把「Everything is a plugin」作为核心设计,模型、工具、提示词、存储、上下文甚至界面都能通过插件替换或组合。内测用户已经做出了长期记忆、界面修改等插件。 简单说,Codex 更像一个做好的 Agent,DeepSeek Harness 更像一套组装 Agent 的运行时。用户不只是在选模型,也可以自己决定 Agent 用什么工具、遵守什么规则、怎么工作。

08-13 19:49

AI代码审查平台CodeRabbit完成1.43亿美元融资,Atomico等领投

Odaily星球日报讯 英伟达支持的 AI 代码审查平台 CodeRabbit 宣布完成 1.43 亿美元融资,估值达 15 亿美元,本轮融资由 Atomico 和 Smash Capital 联合领投,BMW i Ventures 和 Datadog 等机构参投,截至目前 CodeRabbit 累计融资金额已超过 2 亿美元。 CodeRabbit 主要利用人工智能自动审查软件代码,帮助开发者识别代码缺陷、安全风险以及潜在问题。其产品能够在开发流程中对 AI 生成及人工编写的代码进行自动审查,并向开发者提供问题反馈和改进建议。(彭博社)

08-11 17:03

Spotify把Claude、Gemini和Codex塞进一个总控台,1300名工程师已在用

据动察 Beating 监测,Spotify 推出 AI 编程工具 Xirp。它把 Claude Code、Gemini CLI 和 Codex 接进同一个工作台,可以同时跑多个 Agent。中途换工具,项目上下文也能直接带过去。 Spotify 已经用 Xirp 跑了超过 3.6 万次 Agent 会话。官方称已有 1300 多名 Spotify 工程师使用。Xirp 可以同时协调 50 多个会话,每个任务单独放进一个 Git worktree,多个 Agent 能在同一代码库并行干活,互不干扰。 更核心的是「团队记忆」。接上 Spotify Portal 后,Agent 能直接读取服务架构、依赖关系、负责人和历史架构决策。一次会话积累的上下文也会存回 Portal,其他工程师或 Agent 可以接着做。 Xirp 更像一个 Coding Agent「总控台」。Spotify 不押注某一家模型,而是让 Claude、Gemini、Codex 随时可换。Spotify 此前已经把内部开发平台 Backstage 开源,又推出了商业版 Portal;现在 Xirp 再把多 Agent 调度接了进来。