Google DeepMind高管称AI万亿美元投资押注“递归自我改进”
相关推荐
前Google DeepMind工程负责人做Fo:AI干不了,直接叫真人上
动察 Beating AI 快讯,前 Google DeepMind 工程负责人 Shivani Poddar 创办的 Wajo,正在主推个人 AI Agent Fo。它可以替用户打电话、发邮件、订服务和付款。AI 自己办不了的事情,会直接转给真人助理继续处理。 比如联系没有 API 的理发店、私人教练或本地商家,Fo 如果自己搞不定,就让真人帮用户打电话、沟通需求、把事情办完。真人只会拿到完成任务需要的信息,不会直接看到用户的全部聊天记录。 Wajo 还拿 104 个现实任务做了自测,每个任务重复 3 次。整个测试不使用真人兜底,Fo 的任务完成率为 71%,OpenClaw 为 42%,前者相对高约 69%。另一组安全测试专门检查 AI 会不会擅自联系别人、泄露隐私或做未经授权的决定,Fo 的通过率为 94%。
DeepMind突传实现RSI:三个大写字母点燃社区
动察 Beating AI 快讯,AI 社区突然疯传 Google DeepMind 已经实现 RSI。 RSI 即递归自我改进,被很多人视为通往超级智能最关键的一步。AI 可以自己改进训练方法、代码和模型,造出更强的下一代,再让下一代继续升级。真正跑通后,AI 研发可能进入自我加速循环。 起因是爆料账号 lyra 给 Google DeepMind 发了一句「huge congRatulationS Indeed!」,其中三个异常大写字母正好拼成 RSI。随后 Lentils 又贴出一张疑似内部模型列表,里面出现 rsi-model-liverl-le。他还声称 Google 内部有 10 个同系列训练模型槽位,但没有贴出对应截图。 传闻也未必是假的。路透社 8 月报道,谷歌联合创始人 Sergey Brin 已要求 DeepMind 加快 Gemini 研发,并重点推动递归自我改进。DeepMind 6 月的官方报告也把「recursive improvement」列为 AGI 走向 ASI 的四条潜在路径之一。
传Google DeepMind拟裁超1/3:短期停更Pro,资源转向Flash
据动察 Beating 监测,Google DeepMind 正在酝酿进一步重组,可能裁掉三分之一甚至更多员工。GDM 目前约有 7000 至 8000 人,重组将重点精简岗位和实际工作不匹配的冗余人员。 更大的变化是模型路线。谷歌短期没有更新 Pro 模型的计划,也将减少对 Fable、Opus 同级超大旗舰模型的投入,把更多资源转向成本更低、迭代更快的 Flash。 这可能和 GDM 能拿到的资源有关。GDM 最近一个考核年的整体 OKR 只有 0.5/1,过去一段时间很难争取到更多大型模型训练资源。搜索、YouTube、Gmail 等谷歌核心业务同样需要大量 TPU。 还有一个内部细节或许可以解释为什么谷歌 Gemini 模型体验不佳:GDM 核心团队此前从未真正把 Gemini 当成日常主力模型,反而是非核心团队仍被要求使用 Gemini。
Google DeepMind发布Lyria 3.5音乐生成模型,支持生成最长3分钟完整歌曲
BlockBeats 消息,7 月 30 日,Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,重点提升音乐结构、歌词质量、指令遵循、人声表现及歌曲时长控制能力,可直接生成最长 3 分钟的完整歌曲,而非仅数十秒音频。 据介绍,Lyria 3.5 仍采用 latent diffusion 架构,在时间音频 latent 空间进行扩散生成,训练数据为带有不同粒度文本标注的音频,并通过 SFT 及结合人类、Critic 反馈的强化学习进行后训练,所有生成内容均嵌入 SynthID 水印。不过,Google 未披露训练数据规模、来源及量化 Benchmark,仅表示相较 Lyria 2,在音频清晰度和歌词指令遵循方面取得显著提升。 此外,Lyria 3.5 首发集成至 Flow Music,后者支持对话式音乐创作、Stem 分轨、Remix、音乐发布、播放列表生成,并可联动 Veo 生成音乐视频,还支持开发音频插件、音乐游戏及自定义 DAW,进一步整合 Lyria、Veo 与 Gemini,构建覆盖音乐创作、编辑、发布和分发的完整生态。
Google Vids 免费开放 1080p AI 视频生成
火星财经消息,Google 于 9 月 23 日宣布,任何拥有 Google 账户的用户均可在其浏览器端视频编辑器 Google Vids 中免费生成 1080p 高清视频,入口为 vids.new。该功能基于 Gemini Omni 1.1 Flash 模型,可将文本提示、照片、音频或已有片段转化为新视频。此前这类生成能力大多需要订阅付费才能使用。Google 同时加入多项此前需付费工具才能使用的编辑控制:场景延展可在保持光线、人物与场景一致的前提下延长片段;用户可设定精确的片段时长,以对齐脚本或旁白;还能将分辨率较低的旧 AI 片段升级至 1080p,无需重新生成。该工具生成的每段视频都嵌入 Google DeepMind 的 SynthID 隐形水印,肉眼不可见但可被机器读取,用户可通过 SynthID Detector 检测片段是否由 AI 生成。免费额度因账户类型而异:个人 Google 账户获得标准额度,付费 AI 套餐可解锁更多,Workspace 商业版与企业版订阅者获得更大生成池及团队管理控制。Gemini Omni 于 2026 年 5 月作为 Google AI Plus、Pro 和 Ultra 订阅者的付费功能推出,免费访问此前仅限于 YouTube Shorts 和 YouTube Create。
Google加快推出Gemini 4,力争重新追上OpenAI和Anthropic
Google正在加快推进新一代旗舰AI模型Gemini 4,目标是在今年年底前更早发布首个版本。Google DeepMind负责人Koray Kavukcuoglu表示,Gemini 4目前已经进入后训练阶段,公司希望尽快推出早期后训练版本,并在发布后持续进行快速迭代。(新浪财经)