返回 7*24 快讯
来源MarsBit

微软AI发布首款推理模型MAI-Thinking-1及六款原生新模型,推出私有强化学习「前沿微调」服务

据动察 Beating 监测,微软 AI 部门(Microsoft AI,简称 MAI)负责人穆斯塔法·苏莱曼(Mustafa Suleyman)在 Build 2026 开发者大会上宣布推出全新自研的 MAI 原生模型家族。该系列共包含 7 款模型,涵盖推理、编程、图像、转写和语音等领域,全部由微软从零训练,未使用任何第三方模型进行知识蒸馏,且所有数据集均已获得合规授权。微软表示,将致力于构建「人本超智能(Humanist Superintelligence)」,确保前沿 AI 作为人类的辅助工具并接受人类监督。同时,微软已上线的 GB200 算力集群也已全面投入使用,用于推动这一模型生态的持续迭代。 MAI 家族的旗舰推理模型 MAI-Thinking-1 拥有 350 亿活跃参数,采用混合专家(MoE)架构,提供 128K 上下文窗口。在 SWE-bench Pro 等主流软件工程与数学推理评估中,该模型达到了与 Claude Opus 4.6 相当的水平,且在盲测人类评估中优于 Claude Sonnet 4.6。面向编程场景,MAI 推出了拥有 50 亿参数的智能体编程模型 MAI-Code-1-Flash,该模型将深度整合至 GitHub Copilot 及 VS Code,以更低的推理成本提供与 Claude Haiku 相当的表现。在多模态方面,MAI-Image-2.5 及其 Flash 变体支持高精度文生图与图像编辑,图像质量评分超越了 Nano Banana Pro;语音与转写方面则推出了 SOTA 精度、高出竞品 5 倍速度的 43 语言转写模型 MAI-Transcribe-1.5,以及支持 15 种语言、具备情绪控制和零样本克隆的语音生成模型 MAI-Voice-2 及其 Flash 变体。上述模型不仅在 Azure AI Foundry 部署,还将上架 OpenRouter、Fireworks 和 Baseten,并首次支持开发者自行微调权重。微软还透露,通过将模型与自研芯片 Maia 200 进行联合软硬协同优化,实现了 1.4 倍的计算效能提升。 除基础模型发布外,微软推出了基于强化学习环境(RLE)的「前沿微调(Frontier Tuning)」服务。该服务允许企业在完全受控的隔离环境(「训练健身房」)中,利用其内部的操作轨迹、决策序列和专业数据对 MAI 模型进行定制训练。测试表明,经过 Frontier Tuning 后的定制模型效率大幅提升,其中面向 Excel 优化后的 MAI 模型性能对齐 GPT-5.4,但效率高出 10 倍;为麦肯锡定制的 MAI 模型在达成最高胜率的同时降低了近 10 倍成本。此外,微软宣布与全球顶尖医疗机构梅奥诊所(Mayo Clinic)达成战略合作,基于梅奥的临床数据和微软的 AI 底座联合开发临床推理大模型。该模型由梅奥诊所拥有所有权,将首先部署在梅奥内部用于早期诊断与治疗方案设计,随后通过 Azure AI Foundry 开放给其他医疗机构。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

06-03 09:27重要

微软开发者大会聚焦AI Agent全栈:自研MAI模型、Foundry、Windows本地AI与量子芯片齐发

BlockBeats 消息,6 月 3 日,2026 年微软 Build 大会在旧金山启动,核心主题转向「可落地、可治理的 AI Agent 平台」。微软发布自研 MAI 模型家族,覆盖推理、编程、图像、语音和转写等能力,其中 MAI-Thinking-1 是其首款旗舰推理模型;Microsoft Foundry 获得大规模更新,新增 Agent 运行时、工具箱、记忆、企业知识检索 Foundry IQ、Voice Live、评估与治理工具等,强化从原型到生产部署的 Agent 开发链路。 Windows 侧,微软将本地 AI 作为开发者平台重点,推出更面向开发者的 Windows 配置、智能 Shell/Terminal、Agent 沙箱、WSL 能力升级,并强调 Foundry on Windows 让小模型、Agent 推理和本地编码模型可在 PC 端运行。 硬件方面,微软发布面向 AI 开发者的 Surface RTX Spark Dev Box,搭载 NVIDIA RTX Spark superchip,最高提供 1 petaflop AI 算力和 128GB 统一内存,用于本地运行、微调大模型和 Agent 工作流。 此外,微软还发布下一代拓扑量子芯片 Majorana 2,称其量子比特可靠性较上一代提升 1000 倍,平均寿命达 20 秒,并把实现可扩展量子计算机的时间表推进至 2029 年;Microsoft Discovery 也正式 GA,用于科研和工程团队通过 AI Agent 加速研发。 截至最新发文时,微软盘后股价下跌 0.65%,周二收盘下跌 4.17%。

06-03 09:56

微软在Build大会推出七款新模型,涵盖推理、代码、图像等

PANews 6月3日消息,据官方消息,微软在Build大会推出七款新模型,涵盖推理、代码、图像、转录和语音等领域,包括MAI Thinking-1、MAI Code-1-Flash、MAI Image-2.5、MAI Image-2.5-Flash、MAI Transcribe-1.5、MAI Voice-2和MAI Voice-2-Flash。这些模型基于清晰的数据来源从头构建,注重效率并可无缝协同工作。旗舰推理模型MAI-Thinking-1在STEM推理和编码任务上与同类模型具有竞争力。

07-28 03:09

Microsoft AI推出全新自主研发的网络安全模型

BlockBeats 消息,7 月 28 日,Microsoft AI 推出了全新的自主研发网络安全模型 MAI-Cyber-1-Flash,它表示,该模型运行于 MDASH 平台中——一款多智能体框架,可检测并修复大规模代码库中的漏洞。 MDASH 表示,MAI-Cyber-1-Flash+GPT-5.4 模型组合在 CyberGym 基准测试中比 Mythos 高出 12 分。Microsoft AI 称,他们在 MDASH 中提供的此模型配置,价格比其此前最优方案(GPT-5.4 + 5.4 mini + 5.3 codex)低 50%。(金十)

07-16 07:20

SpaceXAI宣布开源Grok Build

BlockBeats 消息,7 月 16 日,马斯克旗下 SpaceXAI 宣布开源 Grok Build,并重置所有用户的使用限制。 针对用户关于隐私的问题,公司表示,自上线以来,Grok Build 完全尊重零数据保留(ZDR)原则。所有用户始终能够在命令行界面中禁用数据上传。在早期测试版中,非 ZDR 用户默认启用了数据保留。 自 7 月 12 日起,公司已为所有 Grok Build 用户禁用默认数据保留,此外正在删除之前保留的所有编码数据,确保每位用户的偏好得到尊重。 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。

07-14 09:28

xAI回应Grok Build上传完整代码库:将清空此前所有用户数据

据动察 Beating 监测,xAI 回应 Grok Build 上传完整代码库争议。官方称,开启零数据保留(ZDR)的团队,代码和运行记录不会被保存。通过 API 密钥使用 Grok Build,也遵守这项设置。 未开启 ZDR 的用户,可以在 CLI 输入 /privacy 关闭数据保留。此前同步的数据也会被删除。 Grok Build 负责人 Andrew Milich 称,修改隐私设置后,系统会追溯删除已经同步的数据。 马斯克随后表示,作为预防措施,SpaceXAI 将彻底删除此前上传的所有用户数据,不留下任何内容。 不过,这次回应主要解释了如何停止保存和删除数据。xAI 仍未说明,Grok Build 为什么默认上传整个 Git 仓库。

07-13 09:48

Grok Build被曝上传整个代码库,密钥和Git历史都可能被偷走

据动察 Beating 监测,安全研究者对 Grok Build CLI 0.2.93 进行抓包。结果显示,这款 xAI 编程 Agent 会把当前 Git 仓库整体上传到云端。内容包括所有 Git 跟踪文件和完整提交历史,不限于 Agent 实际读取的代码。 研究者要求 Grok「不要读取任何文件」,仍从上传包中还原出未被打开的诱饵文件。相同结果在第二个仓库中复现。测试一个 12GB 仓库时,中止前已有 5.5GB 数据上传成功。 如果 Grok 读取 .env,其中的 API 密钥和数据库密码也会原样进入模型请求和会话存档。关闭「Improve the model」后,整仓上传仍会继续。 xAI 官方文档只说明提示词和文件内容会发往云端推理,没有说明会额外上传完整仓库。