谷歌将允许用户移除其AI生成内容中可见水印
相关推荐
谷歌推出AI生图模型Nano Banana 2 Lite:4秒出图,1元钱做四张
火星财经消息 7月1日消息,谷歌发布新款自研AI图像与视频生成模型Nano Banana 2 Lite,宣称相比上一代速度更快、使用成本更低。据介绍,Nano Banana 2 Lite可在4秒内生成一张图像,延迟较此前明显下降,适合需要快速反复修改方案,或在短时间内批量生成大量图像的工作。生成一张1K图像约0.0336美元(约合0.23元);相比之下,标准版Nano Banana 2的1K图像约0.067美元,约为Lite版两倍,Nano Banana Pro的1K/2K图像约0.134美元,约为Lite版四倍。 谷歌还扩大了Gemini Omni Flash的开放范围。Gemini Omni Flash最初在今年早些时候的谷歌I/O大会上亮相,生成视频的收费标准为每秒0.10美元。谷歌同时展示了新演示应用Omni Product Studio,可以把Omni生成的静态图像转化为“电影级”电商视频。“借助这两个模型,开发者可以构建完整的端到端多媒体体验,把快速图像生成与视频制作、编辑衔接起来。”(广角观察)
谷歌推出Gemini Omni并更新Google Vids个人数字形象功能
Odaily星球日报讯 据市场消息:谷歌(GOOG.O)推出 Gemini Omni,并更新 Google Vids 个人数字形象功能,Google Vids 上线 Gemini Omni 和个人数字形象功能,面向 Google AI Pro、AI Ultra 订阅用户及 Workspace 企业客户开放。(金十)
Google视频模型重回榜首:Gemini Omni Flash登顶Video Arena
据动察 Beating 监测,Google DeepMind 新近公测的视频生成模型 Gemini Omni Flash,在 Video Arena 盲测天梯榜以 1404 的 Elo 评分登顶第一。新模型领先此前霸榜的字节跳动 Seedance 2.0 Mini 整整 101 分,刷新了这一榜单的最大分差纪录。 Video Arena 作为基于人类盲测投票的偏好榜单,此前一直由字节跳动旗下的 Seedance 系列模型占据前三。其中,Seedance 2.0 Mini 凭借更好的多镜头画面稳定性与更快的生成速度,以 1303 分位居第一。 此次 Gemini Omni Flash 的登顶标志着 Google 视频生成模型在半年内实现了对字节跳动等竞争对手的反超,从 Veo 时代的落后地位一举跃升至领跑位置。
谷歌Pixel部署零拷贝MTP,Gemini Nano推理提速超50%且省内存
据动察 Beating 监测,谷歌在 Pixel 9 与 Pixel 10 系列设备中部署了多 Token 预测(MTP)架构,直接加速内置的 Gemini Nano v3 模型。通过将轻量级 Transformer 预测头附加到已冻结的主模型尾部,新架构在完全保留原有安全对齐与输出质量的同时,将设备端推理速度提升了 50% 以上。 传统的投机解码需要运行一个独立的草稿模型来预测候选 Token。这不仅额外抢占手机的运行内存,且由于独立模型无法访问主模型的内部隐藏状态,导致预测准确率受限。新架构通过在冻结的主模型尾部嵌入 MTP 头,成功复用主模型已计算的特征激活,显著提升了候选 Token 的预测准确率。 为避免草稿计算在自回归生成时产生重复的运行内存开销,谷歌设计了零拷贝(zero-copy)机制。传统方案中,草稿模型生成候选词时需要维护独立的键值缓存(KV cache)记忆,而零拷贝机制让外挂预测头直接通过交叉注意力(Cross-Attention)去读取主模型已有的缓存。这不仅消除了草稿预测的启动延迟,还为手机节省了约 130MB 的运行内存空间。 在通知摘要与文本校对等 Pixel 实际业务中,MTP 架构使模型单次推理平均能成功多预测近 2 个 Token,降低了主处理器因校验而频繁被唤醒的频率,从而节省了系统功耗。在智能回复等高度结构化文本生成任务中,Token 接受率提升达 55%。
谷歌发布全新Gemini Omni模型,一句话让AI修改视频
火星财经消息 5月20日消息,谷歌发布Gemini模型家族旗舰版Gemini Omni,这是一款基于其在世界模型方面积累的新型视频生成模型。据介绍,Gemini Omni可以基于多种输入生成视频,并支持对话式编辑。用户可以通过自然语言修改角色、背景和场景,也可以上传自拍并将其转换成其他风格或内容。DeepMind首席执行官哈萨比斯称,未来Omni将能够根据任何输入生成任何输出,首款模型Gemini Omni Flash将于今年夏季推出。(广角观察)
消息人士:谷歌重组部门全力发展Gemini
BlockBeats 消息,8 月 13 日,据路透社援引消息人士报道,谷歌 (GOOG.O) 母公司 Alphabet 正对 Google DeepMind 进行大规模领导层调整,部分团队将从 DeepMind 转入谷歌企业体系,进一步削弱 DeepMind 自主性。 消息人士称,谷歌联合创始人谢尔盖·布林近几个月敦促核心 AI 员工「全力投入」Gemini 模型,并推动「递归式自我改进」等 AI 方向研发。此次调整后,DeepMind 负责人戴米斯·哈萨比斯转任董事长,其副手科拉伊·卡武库奥卢接任领导职责。谷歌表示,卡武库奥卢将对 DeepMind 重大决策拥有最终决定权。 消息人士称,由于内部测试显示新版 Gemini 旗舰模型在编程等领域仍落后竞争对手,谷歌已将发布时间推迟两个月。分析认为,Alphabet 此次重组旨在加快 AI 商业化并重新夺回模型竞争优势,但部分员工担忧,DeepMind 长期科研自主性可能进一步下降。