3.7发布仅两周,谷歌内部已测试Gemini 3.8 Flash
相关推荐
Gemini 3.8 Flash明天见?爆料称已完成生产部署
动察 Beating AI 快讯,Gemini 3.8 Flash 可能马上就要上线。爆料者 lyra 称,gemini-3.8-flash 已经完成部署,将在「明天」发布。 上周,《Business Insider》已经拿到内部截图。Gemini 3.8 Flash Preview 出现在 Google 内部编码平台 Jetski。一名试用员工称,它已经明显好于 3.7 Flash。 3.8 Flash 内部代号为 skimaki。这次主要在修 3.7 Flash 暴露的问题,同时减少模板化、啰嗦的「AI 废话」。 Gemini 3.7 Flash 才在 8 月 13 日发布,两代间隔还不到三周。
Google 员工已测试下一代 Gemini 3.8 Flash 模型
火星财经消息,据 Business Insider 报道,Google 本月刚发布新 AI 模型后,部分员工已开始在内部编码平台 Jetski 上测试预览版 Gemini 3.8 Flash。一名测试员工称,该模型已明显优于 3.7 Flash,但强调目前过早,尚无法全面评价。Google 对此不予置评。在 3.5 Pro 仍未推出、Anthropic 与 OpenAI 持续加速的背景下,Google 已不再拥有前沿模型,转而加码速度更快、成本更低的 Flash 系列“主力模型”,用于编码和运行智能体。Gemini 3.6 Flash 于 7 月推出,3.7 Flash 仅三周后跟进。CEO 桑达尔·皮查伊在 Q2 财报会上表示,公司目标接近每月发布一次。员工预览暗示 Gemini 3.8 Flash 公开推出可能不远,但并非保证。部分 AI 观察者认为已在 Arena AI 基准测试网站上发现该模型踪迹,Google 此前曾用该平台测试即将发布的版本。Google 今年早些时候还推出了 Gemini Spark 智能体。
谷歌最快将于周三发布Gemini 3.8 Flash
动察 Beating AI 快讯,据《华尔街日报》记者 Erin Woo 援引员工消息报道,谷歌的人工智能研究部门将发布 Gemini 3.8 Flash 新模型,其编码能力得到显著增强。该模型内部代号为「Skimaki」,最早可能于周三(9 月 2 日)上线。在与谷歌内部编码工具 Jetski 的对比测试中,公司工程师对这款新模型的偏好程度超过了 Anthropic 的 Opus。
谷歌主力模型Gemini 3.5 Flash原生支持电脑操控,解锁企业级智能体自动化
据动察 Beating 监测,谷歌将电脑操控 (Computer Use) 功能作为内置工具,直接整合进主力大模型 Gemini 3.5 Flash。 在原生整合前,开发者必须调用专门的 Gemini 2.5 电脑操控模型才能执行代理任务。原生集成后,开发人员与企业用户能够直接通过 Gemini API 或谷歌云 Gemini 企业智能体平台 (Gemini Enterprise Agent Platform,即原 Vertex AI 平台) 让主力模型操控设备,简化了智能体 (Agent) 开发架构。 内置的电脑操控工具通过接收浏览器、移动端或桌面环境的屏幕截图,进行视觉感知与步骤推理,随后输出鼠标点击、键盘输入、滚轮滚动及菜单导航等操作指令,用以完成软件持续测试、跨网页数据采集等长流程自动化任务。为了方便调试与审计,模型生成指令时会附带「意图」 (intent) 字段,用以说明每一步操作的逻辑。 针对智能体在真实网络环境中可能遭遇的提示词注入风险,谷歌对模型进行了定向对抗训练,并提供两项可选防护:涉及资金支付、文件删除等不可逆操作时强制引入人工核准;截图中若发现间接注入指令则自动熔断任务。 目前,Browserbase 提供了在线托管演示环境 (gemini.browserbase.com),谷歌官方也同步在 GitHub 开源了名为 computer-use-preview 的参考实现代码。
Gemini3.8 Flash正式上线:价格不变,多项评测胜过Opus5
动察 Beating AI 快讯,Google 正式上线 Gemini 3.8 Flash。新模型继续主打长时间软件工程和自主 Agent。上下文约 100 万 Token,最高输出 6.5 万 Token。Google 的托管 Antigravity Agent 也已经默认换成 3.8 Flash。 Google 自家对比表里,3.8 Flash 在 14 组分数中拿下 8 组第一。DeepSWE v1.1 从 65.3% 升到 71.0%,接近 Opus 5 的 74.0%。Terminal-bench 2.1 则达到 89.4%,略高于 Opus 5 的 89.1% 和 GPT-5.6 Sol 的 88.8%。金融 Agent、法律 Agent、复杂图表推理和长视频理解也拿到最高分。 不过它没有全面超过旗舰。Terminal-bench 4.0 只有 19.1%,Opus 5 是 51.8%。OSWorld-2.0 也以 59.0% 落后于 Opus 5 的 75.4%。 3.8 Flash 当前输入 0.75 美元、输出 3.75 美元/百万 Token,和 3.7 Flash 一样。两项单价都只有 Opus 5 的 15%。优惠到 12 月 31 日,2027 年 1 月 1 日起翻倍。
Gemini 3.7 Flash成爆款:上线一周破增长纪录
动察 Beating AI 快讯,谷歌 CEO Sundar Pichai 表示,Gemini 3.7 Flash 上线首周就打破了此前 Gemini 模型的增长纪录,成为谷歌迄今增长最快的 Gemini 模型。不过谷歌没有公布具体增长口径和使用规模。 这款模型确实踩中了性价比甜点区。Artificial Analysis 给它的综合智能指数为 56,高推理模式输出速度约 340 token/s,每项评测任务成本约 0.40 美元,并进入智能与完成时间的帕累托前沿。中等推理模式成本进一步降至 0.26 美元,进入智能与成本的帕累托前沿。 ARC Prize 的独立验证中,Gemini 3.7 Flash 高推理模式在 ARC-AGI-2(抽象推理基准)拿到 84.6%,每项任务成本仅 0.25 美元。 谷歌也迅速把 3.7 Flash 铺进自家产品。Gemini App、Antigravity、AI Studio 已经接入,Google Search 也开始使用该模型。