返回 7*24 快讯
来源MarsBit

腾讯继续猛挖顶级AI人才:曝xAI多模态负责人加入混元

动察 Beating AI 快讯,xAI 多模态理解负责人蔺旭东被曝加入腾讯混元。蔺旭东此前曾在 Google DeepMind 参与 Gemini 多模态模型研发,之后加入 xAI,负责多模态理解方向。 这已经是腾讯不到一年内从国外大厂吸纳的第三名核心研究者。姚顺雨已出任腾讯首席 AI 科学家,前 OpenAI 研究员田永龙也在 7 月加入,参与视觉语言模型研发。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-14 11:37

传Google DeepMind拟裁超1/3:短期停更Pro,资源转向Flash

据动察 Beating 监测,Google DeepMind 正在酝酿进一步重组,可能裁掉三分之一甚至更多员工。GDM 目前约有 7000 至 8000 人,重组将重点精简岗位和实际工作不匹配的冗余人员。 更大的变化是模型路线。谷歌短期没有更新 Pro 模型的计划,也将减少对 Fable、Opus 同级超大旗舰模型的投入,把更多资源转向成本更低、迭代更快的 Flash。 这可能和 GDM 能拿到的资源有关。GDM 最近一个考核年的整体 OKR 只有 0.5/1,过去一段时间很难争取到更多大型模型训练资源。搜索、YouTube、Gmail 等谷歌核心业务同样需要大量 TPU。 还有一个内部细节或许可以解释为什么谷歌 Gemini 模型体验不佳:GDM 核心团队此前从未真正把 Gemini 当成日常主力模型,反而是非核心团队仍被要求使用 Gemini。

08-12 08:43重要

Gemini月活用户突破10亿,成为Google史上增长最快产品,语音成为核心交互方式

据 动察 Beating 监测,Google 宣布 Gemini 应用月活跃用户已正式突破 10 亿,成为公司历史上增长最快的产品。用户行为数据显示语音正成为核心交互方式——63% 的用户直接与 Gemini 对话,忙碌父母使用语音处理日常任务的概率比其他用户高出 43%。超过 20% 的 Gemini Live 交互已超越纯语音,用户通过实时摄像头画面和屏幕共享进行即时问题解决,在 DIY 爱好者和学生群体中尤为流行。Android 端 Gemini 可跨 40 余款主流应用自动执行操作,涵盖叫车、餐厅预订等场景。 学生群体中 38% 的学习请求包含附件。面向小企业主的创意功能需求旺盛——Gemini 每日生成超 1.5 亿张图片,支持图像、视频与音频一体化创作。苹果生态表现强劲,iOS 端月活用户超 1 亿,macOS 重度用户的提示频次约为其他平台的两倍。Google 表示将继续以打造「最个性化、最主动、最强大的助手」为目标向下一批 10 亿用户迈进。 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。

08-05 12:19

谷歌Gemini 3.5 Pro传8月10日发布,爆料称难敌OpenAI和Anthropic

据动察 Beating 监测,爆料博主 Dan 称,谷歌可能在 8 月 10 日发布 Gemini 3.5 Pro。Dan 最初预告 8 月 12 日,数小时后又把日期改为 8 月 10 日。 谷歌 5 月曾称 Pro 版将在 6 月推出,但最终跳票。7 月 21 日,谷歌只表示模型正在与合作伙伴测试,准备好后会尽快开放。延迟与编程能力未达到内部目标有关。 Dan 还判断,新模型整体会很强,但未必能明显超过 Anthropic 和 OpenAI 的顶级模型。

08-03 22:26

Google DeepMind高管称AI万亿美元投资押注“递归自我改进”

Odaily星球日报讯 Google DeepMind 首席战略官 Jasjeet Sekhon 表示,当前 AI 行业规模空前的资本投入,背后的关键投资逻辑之一,是押注未来 AI 系统实现“递归自我改进”(Recursive Self-Improvement,RSI)。 Sekhon 近日在加州大学伯克利分校举办的 Agentic AI Summit 上表示,AI 产业目前投入的大量资本,最终需要由一种更高级的能力来证明其价值——即 AI 能够自动改进自身,并创造能力更强的下一代系统。 他指出,RSI 已经成为 AI 投资逻辑中的重要组成部分。与传统依靠人工研发和训练迭代的模式不同,递归自我改进设想的是 AI 系统能够自主优化算法、改进模型架构,并持续提升自身能力。 Sekhon 认为,RSI 正在取代 AGI(人工通用智能),成为当前 AI 领域新的核心叙事。随着 OpenAI、Google、Anthropic 等公司以及云计算巨头持续投入巨额资金建设算力基础设施,市场正在押注 AI 未来可能从“规模扩展”(scaling)阶段迈向“自我增强”阶段。 不过,RSI 是否能够实现仍存在较大争议。目前 AI 模型虽然已具备代码生成、工具调用和自动优化能力,但距离真正意义上的自主递归改进仍面临技术、安全和可控性挑战。(The Information)

07-30 01:36

Google DeepMind发布Lyria 3.5音乐生成模型,支持生成最长3分钟完整歌曲

BlockBeats 消息,7 月 30 日,Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,重点提升音乐结构、歌词质量、指令遵循、人声表现及歌曲时长控制能力,可直接生成最长 3 分钟的完整歌曲,而非仅数十秒音频。 据介绍,Lyria 3.5 仍采用 latent diffusion 架构,在时间音频 latent 空间进行扩散生成,训练数据为带有不同粒度文本标注的音频,并通过 SFT 及结合人类、Critic 反馈的强化学习进行后训练,所有生成内容均嵌入 SynthID 水印。不过,Google 未披露训练数据规模、来源及量化 Benchmark,仅表示相较 Lyria 2,在音频清晰度和歌词指令遵循方面取得显著提升。 此外,Lyria 3.5 首发集成至 Flow Music,后者支持对话式音乐创作、Stem 分轨、Remix、音乐发布、播放列表生成,并可联动 Veo 生成音乐视频,还支持开发音频插件、音乐游戏及自定义 DAW,进一步整合 Lyria、Veo 与 Gemini,构建覆盖音乐创作、编辑、发布和分发的完整生态。

07-26 11:22

开源AI联署两天翻倍:OpenAI、谷歌加入,Anthropic没签

据动察 Beating 监测,美国正讨论是否限制可以下载和自行部署的开源模型。英伟达、微软等公司随后发布《开放权重与美国AI领导力》公开信,呼吁政府不要过早设限。签署名单已从首发的 25 家增至 50 家,OpenAI、Google、AMD、Cloudflare、GitHub 和 Cisco 等公司后来加入。 OpenAI 和 Google 虽然靠 GPT、Gemini 等闭源旗舰收费,也分别推出了 gpt-oss 和 Gemma 开放模型。签字不会影响它们继续卖闭源模型,却能保住开放模型这张牌。 Anthropic 没有签,也符合它现有的产品和政策路线。它没有 gpt-oss、Gemma 这类开放权重产品,近期又不断强调非法蒸馏和模型泄露风险。 此外,Amazon/AWS、Apple 和 xAI 也没有正式签署。马斯克只是在 X 上公开支持,xAI 并未出现在官方名单。