小米承认MiMo-V2.6会「原地复读」:RL把坏习惯越训越严重,9万美元修复
相关推荐
小米新一代模型MiMo-X首次亮相:Pro、Flash两款模型开启内测
动察 Beating AI 快讯,小米首次公布新一代 MiMo-X 系列,首批包括 MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview 两款模型。目前公开的体验入口是新推出的 Xiaomi MiMo Desktop,获邀用户可限时、限量、免费使用。官方暂未公布两款模型的参数、上下文长度、基准成绩和 API 开放时间。 MiMo-X 面向复杂推理、多 Agent 协作、大型编程项目、Office、网页与交互设计、视频剪辑、3D 生成、音乐生成和电脑操控等专业工作场景。MiMo Desktop 可以直接读取文档、表格、图片、视频等素材,自动拆任务、调用工具和浏览器,并交付可继续编辑的 PPT、网页、App 等成果;大型任务还能拆给多个 Agent 协作。 小米三周前就在财报会上预告,首个 MiMo 桌面应用和新模型即将推出。这次两者一起进入预览测试。
传谷歌新Pro模型首个checkpoint现身,10月或公开发布
动察 Beating AI 快讯,爆料者 lyra 称,谷歌下一款 Pro 已经有了首个 checkpoint(训练过程中保存的一版模型状态),预计 10 月公开。lyra 还预计,9 月会有新的 Flash-Lite,同时 Nano Banana 2 Lite 也会更新。 不过新 Pro 模型最终叫什么还没定。社区有人猜是 Gemini 4 Pro,也有人认为可能是其他 Pro 版本。
小米MiMo公开RL停了:两条训练烧掉347万美元
动察 Beating AI 快讯,小米 MiMo 公开直播的两条强化学习训练目前均已停止。Pro 和 Flash 最后完整完成的都是 30 个训练 step,两条 run 合计花费 347.47 万美元。其中 Pro 花费 262.07 万美元,Flash 花费 85.40 万美元。 砸钱换来的提升很明显。DeepSWE v1.1 上,Pro 从第 1 步的 58.41 提升到 72.57,涨了 14.16 分;Flash 从 48.67 提升到 65.68,涨了 17.01 分。但两条曲线中间都有明显回落,并非训练越久分数就一路上涨。 另外两个看板评测也在涨。Pro 的内部代码评测从 57.54 升至 65.43,AutomationBench 从 45.2 升至 53.1。 训练过程也没那么顺利。Pro 因专家负载不均触发过 GPU OOM,训练集群和评分器也断连重启过;Flash 因基础设施错误从 step 15 重跑。后期小米还过滤了对 Pro 已经过于简单的任务,并把出现异常 rollout 模式的 cyber 数据集从 Pro 后续训练中移除。
DeepSeek V4.1 Flash即将上线,官方称全面超过V4 Pro
动察 Beating AI 快讯,DeepSeek 计划在 9 月 10 日前后正式发布 V4.1 Flash。官方称,经过内部和外部测试,新模型在性能、费用、速度和总用时等指标上已经全面超过 V4 Pro。 V4.1 Flash 上线后,在 V4.1 Pro 发布之前,所有发往 V4 Pro 的请求都会自动切到 V4.1 Flash,并按更便宜的 Flash 价格计费。用户不需要修改原来的 V4 Pro 调用方式。
小米发布MiMo-V2.6模型,称其为当前最强开源模型
动察 Beating AI 快讯,小米今日凌晨正式发布并开源了全新的 Xiaomi MiMo-V2.6 系列。团队表示,MiMo-V2.6 系列包含 Pro 和 Flash 两个原生全模态模型。得益于 RL 算力的扩展,MiMo-V2.6-Pro 在 Artificial Analysis Intelligence Index(AA 综合智能指数)中取得 46 分,超过 Kimi K3 和 Qwen3.8 Max,成为当前最强的开源模型;但与最强的闭源模型 Claude Fable5.1 和 GPT-6 Astra 相比,仍有差距。 团队称,MiMo-V2.6 系列沿用 V2.5 系列的 API 定价,MiMo-V2.6-Pro 刷新了中国国产模型的性价比纪录:在同等智能水平下,价格仅为海外模型的 1/20 至 1/60。
Google推出Gemini 3.8 Flash推理模型,今日起向Pro与Ultra用户开放
PANews 9月2日消息,Google Gemini 宣布其最新 Gemini 3.8 Flash 模型今日起向 Pro 与 Ultra 用户开放。官方称,该模型在日常话题行动建议、文本分析和复杂编码等任务中,将提供更可靠、更全面的回答,以增强高频使用场景下的实用性与执行效率。