返回 7*24 快讯
来源MarsBit

谷歌最快将于周三发布Gemini 3.8 Flash

动察 Beating AI 快讯,据《华尔街日报》记者 Erin Woo 援引员工消息报道,谷歌的人工智能研究部门将发布 Gemini 3.8 Flash 新模型,其编码能力得到显著增强。该模型内部代号为「Skimaki」,最早可能于周三(9 月 2 日)上线。在与谷歌内部编码工具 Jetski 的对比测试中,公司工程师对这款新模型的偏好程度超过了 Anthropic 的 Opus。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-01 08:57

Gemini 3.8 Flash明天见?爆料称已完成生产部署

动察 Beating AI 快讯,Gemini 3.8 Flash 可能马上就要上线。爆料者 lyra 称,gemini-3.8-flash 已经完成部署,将在「明天」发布。 上周,《Business Insider》已经拿到内部截图。Gemini 3.8 Flash Preview 出现在 Google 内部编码平台 Jetski。一名试用员工称,它已经明显好于 3.7 Flash。 3.8 Flash 内部代号为 skimaki。这次主要在修 3.7 Flash 暴露的问题,同时减少模板化、啰嗦的「AI 废话」。 Gemini 3.7 Flash 才在 8 月 13 日发布,两代间隔还不到三周。

09-03 02:18

谷歌拟本周推出Gemini 3.8 Flash,内部测试显示编码能力优于Opus

谷歌旗下人工智能研究部门DeepMind正准备推出一款编程能力大幅升级的新模型Gemini 3.8 Flash,内部代号为“Skimaki”。该模型最早可能于当地时间周三(9月2日)上线。知情员工称,这款模型的编码能力较此前版本有显著提升,公司正试图借此补上今年以来相对Anthropic、OpenAI旗舰模型的短板。不过,对外发布窗口尚未由公司正式宣布,行业标准基准分数也尚未公开。(新浪财经)

08-28 12:55

3.7发布仅两周,谷歌内部已测试Gemini 3.8 Flash

动察 Beating AI 快讯,谷歌已经开始内部测试 Gemini 3.8 Flash。《Business Insider》拿到的内部截图显示,新模型名为 Gemini 3.8 Flash Preview,已经向部分员工开放,并出现在谷歌内部编程平台 Jetski 上。 一名已经试用的员工称,3.8 Flash 用起来「明显好于」3.7 Flash,但也表示现在还太早,无法做完整评价。 Gemini 3.7 Flash 在 8 月 13 日正式发布,距离 3.8 内测消息曝光只有 14 天。而 3.7 本身距离 3.6 发布也只有三周。谷歌此前表示,希望把模型更新速度提高到接近每月一次。

08-28 03:11

Google 员工已测试下一代 Gemini 3.8 Flash 模型

火星财经消息,据 Business Insider 报道,Google 本月刚发布新 AI 模型后,部分员工已开始在内部编码平台 Jetski 上测试预览版 Gemini 3.8 Flash。一名测试员工称,该模型已明显优于 3.7 Flash,但强调目前过早,尚无法全面评价。Google 对此不予置评。在 3.5 Pro 仍未推出、Anthropic 与 OpenAI 持续加速的背景下,Google 已不再拥有前沿模型,转而加码速度更快、成本更低的 Flash 系列“主力模型”,用于编码和运行智能体。Gemini 3.6 Flash 于 7 月推出,3.7 Flash 仅三周后跟进。CEO 桑达尔·皮查伊在 Q2 财报会上表示,公司目标接近每月发布一次。员工预览暗示 Gemini 3.8 Flash 公开推出可能不远,但并非保证。部分 AI 观察者认为已在 Arena AI 基准测试网站上发现该模型踪迹,Google 此前曾用该平台测试即将发布的版本。Google 今年早些时候还推出了 Gemini Spark 智能体。

09-02 15:31

Gemini3.8 Flash正式上线:价格不变,多项评测胜过Opus5

动察 Beating AI 快讯,Google 正式上线 Gemini 3.8 Flash。新模型继续主打长时间软件工程和自主 Agent。上下文约 100 万 Token,最高输出 6.5 万 Token。Google 的托管 Antigravity Agent 也已经默认换成 3.8 Flash。 Google 自家对比表里,3.8 Flash 在 14 组分数中拿下 8 组第一。DeepSWE v1.1 从 65.3% 升到 71.0%,接近 Opus 5 的 74.0%。Terminal-bench 2.1 则达到 89.4%,略高于 Opus 5 的 89.1% 和 GPT-5.6 Sol 的 88.8%。金融 Agent、法律 Agent、复杂图表推理和长视频理解也拿到最高分。 不过它没有全面超过旗舰。Terminal-bench 4.0 只有 19.1%,Opus 5 是 51.8%。OSWorld-2.0 也以 59.0% 落后于 Opus 5 的 75.4%。 3.8 Flash 当前输入 0.75 美元、输出 3.75 美元/百万 Token,和 3.7 Flash 一样。两项单价都只有 Opus 5 的 15%。优惠到 12 月 31 日,2027 年 1 月 1 日起翻倍。

08-22 06:52

Gemini 3.7 Flash成爆款:上线一周破增长纪录

动察 Beating AI 快讯,谷歌 CEO Sundar Pichai 表示,Gemini 3.7 Flash 上线首周就打破了此前 Gemini 模型的增长纪录,成为谷歌迄今增长最快的 Gemini 模型。不过谷歌没有公布具体增长口径和使用规模。 这款模型确实踩中了性价比甜点区。Artificial Analysis 给它的综合智能指数为 56,高推理模式输出速度约 340 token/s,每项评测任务成本约 0.40 美元,并进入智能与完成时间的帕累托前沿。中等推理模式成本进一步降至 0.26 美元,进入智能与成本的帕累托前沿。 ARC Prize 的独立验证中,Gemini 3.7 Flash 高推理模式在 ARC-AGI-2(抽象推理基准)拿到 84.6%,每项任务成本仅 0.25 美元。 谷歌也迅速把 3.7 Flash 铺进自家产品。Gemini App、Antigravity、AI Studio 已经接入,Google Search 也开始使用该模型。