Instinct日增10%的代价:算力需求每周翻倍,创始人40%时间都在算怎么买
相关推荐
Instinct和Muse想到一块:Agent免费,靠交易抽成
动察 Beating AI 快讯,个人 AI Agent Instinct 创始人 Noah Shinn 在首次公开长访谈中讲了公司准备怎么赚钱。 Shinn 希望 Instinct 最终能长期免费,不向用户收订阅费。Agent 替用户订酒店、购物等完成交易后,Instinct 再向拿到订单的商家收一小笔佣金。不过这目前还只是他的目标,Instinct 暂时没有承诺永久免费。 Shinn 也明确不想做广告。个人 Agent 会越来越了解用户,也会越来越擅长影响用户的决定。如果平台靠广告挣钱,Agent 就可能开始劝用户买原本没打算买的东西。他更希望 Instinct 只从用户本来就要完成的交易里挣钱。 具体抽多少还没定。Shinn 拿 Shopify、Amazon 和 Apple 的平台抽成做参照。Instinct 目前约一半交易额来自旅行,一些精品酒店愿意为它带来的订单支付最高超过 30% 的佣金,但 Instinct 不一定会收这么高。 巧的是,扎克伯格此前给 Muse 设想的也是这套模式:大多数用户免费使用,Agent 帮用户完成交易后,再向获得生意的商家收费。
950个Claude Agent跑21小时,找到了人类漏掉的生物系统
动察 Beating AI 快讯,Anthropic 自建的分子生物学实验室公布首个成果。人类科学家只给 Claude 一个方向,让它去海量 DNA 数据里寻找值得研究的新型逆转录酶,也就是一种能把 RNA 信息写回 DNA 的酶。约 950 个 Claude Agent 跑了 21 小时,从 20 万多个逆转录酶中筛出 3500 个候选系统,最后缩到 20 个重点对象。 其中一个 Agent 发现,一种奇怪的逆转录酶旁边排列着大量规律重复的 DNA,看起来很像 CRISPR。CRISPR 是细菌天然拥有的一套 DNA 防御系统,后来被人类改造成基因编辑工具,可以按照 RNA 的「导航」找到特定 DNA 并切开。Claude 随后自己数重复序列、分析间距、对比已知系统并搜索论文,最后判断这里可能藏着一套此前没有被完整识别的生物系统。Anthropic 将它命名为 ART。 人类科学家随后在实验室验证。ART 主要存在于噬菌体,也就是专门感染细菌的病毒中。它由逆转录酶、一个功能未知的邻近蛋白和一长串重复 DNA 组成。实验确认,这些重复 DNA 会产生多种短 RNA。少数具有类似结构的已知系统可以切割、复制或改写 DNA,所以 Anthropic 正继续研究 ART 是否也有类似能力。 目前还不知道 ART 到底有什么功能,也不能说它已经可以编辑基因。其中的逆转录酶以前就有人研究过,Claude 新发现的是它和旁边重复 DNA、未知蛋白之间的完整关联。这次 Claude 也没有被提前告知去找 ART,而是自己从大量候选里发现异常、继续追查,再把结果交给人类做实验。Anthropic 称,这类分析如果完全由专家完成,通常需要数周到数月。
给Claude Code装上「剪映」,Hypit让Agent直接做完整视频
动察 Beating AI 快讯,开源项目 Hypit 最近在 GitHub 快速走红,目前已有约 8300 Star。它相当于给 Claude Code、Codex 这类 Coding Agent 加上一套视频制作工具,让原本主要写代码的 Agent,也能开始做视频。 用户丢进去一条参考视频后,Hypit 会把台词、镜头、字幕、B-roll 和特效拆成一套可以反复修改的制作流程。Agent 再调用 Seedance 等视频模型、图片模型、WhisperX 和 FFmpeg,替换人物、台词和素材,重新生成整条视频。 这套方法特别适合批量做相似视频。比如一条广告效果不错,可以保留原来的节奏和结构,只换产品、人物或文案,再快速做出几十个不同版本。一条视频跑通后,后面主要就是换内容,不用每次从头做一遍。 Hypit 本身免费使用,也不强制绑定某个生成模型。不过它采用带额外限制的开源协议,企业内部可以商用;如果拿它做面向多个客户的 SaaS,则需要另行取得商业授权。
个人Agent也有实战榜了:Muse暂列第一,领先Instinct和Grok Bot
动察 Beating AI 快讯,独立评测项目 Assistant Benchmark 开始用真实任务横评个人 AI 助手。它直接让 Agent 订酒店、选餐厅、买东西、回邮件、连接第三方服务,再按实际完成情况打分。每个评分维度都有一个公开的固定任务,并要求有真实运行记录才给分。 目前 Muse 在已经完成的 7 个评分维度中平均 9.1 分,暂列第一;Instinct 测完 11 个维度,平均 8.4 分;Grok Bot 测完 7 个维度,平均 7.3 分。Muse 在购物、邮件和第三方应用连接上都拿到 10 分。 不过这更适合看成一份持续更新的真实体验榜。Muse 的 9.1 目前只是已测 7 个维度的平均分,并不是完整成绩。每个维度目前也只用一个固定任务测试,后续补测后分数和排名都可能变化。
Instinct火到算力告急,刚融2.5亿又要融10亿
动察 Beating AI 快讯,个人 AI 助理 Instinct 正考虑再融资 10 亿美元。它刚完成 2.5 亿美元融资,累计融资已经达到 3.5 亿美元。过去几周,Instinct 多次提示用户服务已满负荷,回复可能变慢。新一轮融资仍处于早期,也可能最终不做。 如果 10 亿美元全部融到,现有投资人预计估值至少要到约 100 亿美元,才能把老股东的稀释控制在 10% 以内。Instinct 目前主要靠租服务器,并大量使用开源模型。创始人 Noah Shinn 还向潜在投资人提过,未来希望自己买芯片,甚至运营数据中心,长期降低算力成本。 竞争也突然变激烈。Meta 刚推出免费的个人 Agent Muse,同样可以替用户购物、订机票和处理日常任务。社区早期对比中,多名测试者都提到 Muse 的速度明显快于 Instinct。
LoopX升到1.0:一个页面管Codex、Claude Code等Agent长任务
动察 Beating AI 快讯,开源项目 LoopX 发布 1.0。它装在 Codex、Claude Code、Cursor 等 Agent 上层,把原本分散在不同会话里的长期任务统一收进一个工作台。 用户可以在一个页面看到所有已接入 LoopX 的任务。哪些正在执行、哪些等你确认、哪些在持续监控、哪些已经排期,都会集中显示。进入单个项目后,还能继续查看不同 Agent 的待办、完成记录、文件和运行状态。 这个工作台可以直接在浏览器打开,也提供 macOS 和 Windows 桌面版。两种入口共用同一套本地服务和任务状态。它不会自动读取电脑上所有 Agent,会显示的是已经注册并接入 LoopX 的 Agent 和任务。 多个 Agent 也可以一起完成同一个目标。它们能分别认领任务、并行工作和相互接力。比如一个 Agent 做完后留下后续任务,下一个 Agent 再接着做。这里的协作靠共享任务和状态完成,并不是让多个 Agent 在一个聊天室里自由对话。