Google 推出 Playground,输入文字描述即可生成可玩游戏
相关推荐
前Google DeepMind工程负责人做Fo:AI干不了,直接叫真人上
动察 Beating AI 快讯,前 Google DeepMind 工程负责人 Shivani Poddar 创办的 Wajo,正在主推个人 AI Agent Fo。它可以替用户打电话、发邮件、订服务和付款。AI 自己办不了的事情,会直接转给真人助理继续处理。 比如联系没有 API 的理发店、私人教练或本地商家,Fo 如果自己搞不定,就让真人帮用户打电话、沟通需求、把事情办完。真人只会拿到完成任务需要的信息,不会直接看到用户的全部聊天记录。 Wajo 还拿 104 个现实任务做了自测,每个任务重复 3 次。整个测试不使用真人兜底,Fo 的任务完成率为 71%,OpenClaw 为 42%,前者相对高约 69%。另一组安全测试专门检查 AI 会不会擅自联系别人、泄露隐私或做未经授权的决定,Fo 的通过率为 94%。
Google推出Gemini 3.8 Flash推理模型,今日起向Pro与Ultra用户开放
PANews 9月2日消息,Google Gemini 宣布其最新 Gemini 3.8 Flash 模型今日起向 Pro 与 Ultra 用户开放。官方称,该模型在日常话题行动建议、文本分析和复杂编码等任务中,将提供更可靠、更全面的回答,以增强高频使用场景下的实用性与执行效率。
传Google DeepMind拟裁超1/3:短期停更Pro,资源转向Flash
据动察 Beating 监测,Google DeepMind 正在酝酿进一步重组,可能裁掉三分之一甚至更多员工。GDM 目前约有 7000 至 8000 人,重组将重点精简岗位和实际工作不匹配的冗余人员。 更大的变化是模型路线。谷歌短期没有更新 Pro 模型的计划,也将减少对 Fable、Opus 同级超大旗舰模型的投入,把更多资源转向成本更低、迭代更快的 Flash。 这可能和 GDM 能拿到的资源有关。GDM 最近一个考核年的整体 OKR 只有 0.5/1,过去一段时间很难争取到更多大型模型训练资源。搜索、YouTube、Gmail 等谷歌核心业务同样需要大量 TPU。 还有一个内部细节或许可以解释为什么谷歌 Gemini 模型体验不佳:GDM 核心团队此前从未真正把 Gemini 当成日常主力模型,反而是非核心团队仍被要求使用 Gemini。
Google DeepMind高管称AI万亿美元投资押注“递归自我改进”
Odaily星球日报讯 Google DeepMind 首席战略官 Jasjeet Sekhon 表示,当前 AI 行业规模空前的资本投入,背后的关键投资逻辑之一,是押注未来 AI 系统实现“递归自我改进”(Recursive Self-Improvement,RSI)。 Sekhon 近日在加州大学伯克利分校举办的 Agentic AI Summit 上表示,AI 产业目前投入的大量资本,最终需要由一种更高级的能力来证明其价值——即 AI 能够自动改进自身,并创造能力更强的下一代系统。 他指出,RSI 已经成为 AI 投资逻辑中的重要组成部分。与传统依靠人工研发和训练迭代的模式不同,递归自我改进设想的是 AI 系统能够自主优化算法、改进模型架构,并持续提升自身能力。 Sekhon 认为,RSI 正在取代 AGI(人工通用智能),成为当前 AI 领域新的核心叙事。随着 OpenAI、Google、Anthropic 等公司以及云计算巨头持续投入巨额资金建设算力基础设施,市场正在押注 AI 未来可能从“规模扩展”(scaling)阶段迈向“自我增强”阶段。 不过,RSI 是否能够实现仍存在较大争议。目前 AI 模型虽然已具备代码生成、工具调用和自动优化能力,但距离真正意义上的自主递归改进仍面临技术、安全和可控性挑战。(The Information)
Google DeepMind发布Lyria 3.5音乐生成模型,支持生成最长3分钟完整歌曲
BlockBeats 消息,7 月 30 日,Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,重点提升音乐结构、歌词质量、指令遵循、人声表现及歌曲时长控制能力,可直接生成最长 3 分钟的完整歌曲,而非仅数十秒音频。 据介绍,Lyria 3.5 仍采用 latent diffusion 架构,在时间音频 latent 空间进行扩散生成,训练数据为带有不同粒度文本标注的音频,并通过 SFT 及结合人类、Critic 反馈的强化学习进行后训练,所有生成内容均嵌入 SynthID 水印。不过,Google 未披露训练数据规模、来源及量化 Benchmark,仅表示相较 Lyria 2,在音频清晰度和歌词指令遵循方面取得显著提升。 此外,Lyria 3.5 首发集成至 Flow Music,后者支持对话式音乐创作、Stem 分轨、Remix、音乐发布、播放列表生成,并可联动 Veo 生成音乐视频,还支持开发音频插件、音乐游戏及自定义 DAW,进一步整合 Lyria、Veo 与 Gemini,构建覆盖音乐创作、编辑、发布和分发的完整生态。
Google Vids 免费开放 1080p AI 视频生成
火星财经消息,Google 于 9 月 23 日宣布,任何拥有 Google 账户的用户均可在其浏览器端视频编辑器 Google Vids 中免费生成 1080p 高清视频,入口为 vids.new。该功能基于 Gemini Omni 1.1 Flash 模型,可将文本提示、照片、音频或已有片段转化为新视频。此前这类生成能力大多需要订阅付费才能使用。Google 同时加入多项此前需付费工具才能使用的编辑控制:场景延展可在保持光线、人物与场景一致的前提下延长片段;用户可设定精确的片段时长,以对齐脚本或旁白;还能将分辨率较低的旧 AI 片段升级至 1080p,无需重新生成。该工具生成的每段视频都嵌入 Google DeepMind 的 SynthID 隐形水印,肉眼不可见但可被机器读取,用户可通过 SynthID Detector 检测片段是否由 AI 生成。免费额度因账户类型而异:个人 Google 账户获得标准额度,付费 AI 套餐可解锁更多,Workspace 商业版与企业版订阅者获得更大生成池及团队管理控制。Gemini Omni 于 2026 年 5 月作为 Google AI Plus、Pro 和 Ultra 订阅者的付费功能推出,免费访问此前仅限于 YouTube Shorts 和 YouTube Create。