蚂蚁开源6B设计模型:专做UI海报,生成后还能拆层继续改
相关推荐
腾讯混元Hy Image3.5 preview上线:最多20张参考图、4K直出
动察 Beating AI 快讯,腾讯混元推出 Hy Image3.5 preview。相比 Hy Image3.0,新版参考图上限从 3 张提高到 20 张,还支持多轮连续编辑,最高可直接生成 4096×4096 的 4K 图片。 Hy Image3.5 preview 已在设计 Agent Miora 上线,9 月 22 日至 10 月 7 日限时免费。Miora 称,新版整体能力较上一代提升约 30%。
ChatGPT Images 2.5上线:生图快50%,改图终于能指哪改哪
动察 Beating AI 快讯,OpenAI 正式发布 ChatGPT Images 2.5,重点升级了生成速度、人物还原和改图体验。相比 Images 2.0,新版本生成图片的延迟最高可降 50%。拿照片做参考时,它也更能保住人物、宠物等主体的长相和细节。 这次最实用的变化,是改图终于更「听话」了。用户可以直接在图片上圈出要改的位置,再写一句怎么改,比如只换一片花瓣、只改一个物体的颜色,不用反复用文字描述具体在哪。连续改多轮时,模型也更不容易把没要求改的地方一起改掉。 ChatGPT 现在还支持直接画草图来控制构图,也加了海报、周边商品等常用图片模板。Images 2.5 已开始向 ChatGPT、ChatGPT Work 和 Codex 用户开放。 API 同时上线 GPT-Image-2.5 Flare 和 Sunburst。Arena 最新评测中,Sunburst 排第一、Flare 排第二,两款模型同时包揽文生图、单图编辑和多图编辑三个榜单前两名。
Grok视频Agent升到1.5:接入Image 2.0,多镜头连续性升级
动察 Beating AI 快讯,Grok Imagine 的视频创作 Agent 升级到 1.5 版。 这次容易和 6 月发布的 Grok Imagine Video 1.5 搞混。当时更新的是底层视频模型,现在更新的是 Agent 层。Grok Imagine Video 1.5 已于 6 月正式上线。 新版接入最新的 Image 2.0,重点提升生成质量、叙事和多镜头连续性。Grok 称,它更擅长把多个镜头连起来,让前后画面更连贯。目前已经上线 Grok 网页、iOS 和 Android。 Arena 的 Text-to-Video 榜单里,grok-imagine-video-1.5-agent 暂列第 5,得分 1491,高于 Seedance 2.5、Seedance 2.0 和 MiniMax H3。不过目前成绩仍是 Preliminary,排名还可能变化。
微软MAI-Image-2.6-Flash卷性价比:快2.8倍,千张不到20美元
动察 Beating AI 快讯,Microsoft AI 推出 MAI-Image-2.6-Flash,并在 Microsoft Foundry 开放公共预览。它是旗舰模型 MAI-Image-2.6 的加速版,同样支持文生图、图片编辑、多图参考、联网获取最新信息和自动选择画面比例,重点是把生成延迟和成本继续压低。 速度是这次最大的卖点。MAI-Image-2.6-Flash 的生图速度是 GPT-Image-2 Medium 的 2.8 倍,GPU 使用效率高 72%。 但也不是纯靠牺牲画质换速度。Artificial Analysis 当前图片编辑榜里,MAI-Image-2.6-Flash 以 1311 Elo 排第三,略高于 GPT Image 2 high 的 1309;文生图则以 1297 Elo 排第八。旗舰 MAI-Image-2.6 的表现更强,目前分别排图片编辑第一、文生图第二。 微软 Foundry 上 MAI-Image-2.6-Flash 的图片输出价格为每百万 token 19 美元,旗舰 2.6 为 38 美元。Artificial Analysis 按代表性图片折算后,Flash 约为 19.5 美元/千张,而 GPT Image 2 high 约为 211 美元/千张。
蚂蚁百灵金融模型正式开源:MIT许可,123道金融搜索题也放出
动察 Beating AI 快讯,蚂蚁百灵正式开源金融模型 Ling-3.0-flash-Fin。模型拥有 1240 亿总参数、51 亿激活参数,支持 256K 上下文。官方放出的 BF16 权重约 255GB,采用 MIT 许可证,可以用 vLLM 和 SGLang 自行部署。 一起开源的还有金融搜索基准 FinFIRST。它由蚂蚁集团开发,中金公司投行团队提供专业支持,50 多名金融专业人士参与出题和验证。最终只有 9.78% 的候选题通过筛选,留下 123 道题。其中 61.8% 需要计算,32.5% 需要同时查多个来源。 每道题会拆成多个评分点,分别检查 AI 有没有找对数据、用对信源、核准时间和统计口径,以及计算结果是否正确。整套数据共有 701 个细分评分点。现在题目、参考答案和评分标准全部公开,采用 Apache 2.0 许可证。
OpenAI下一代生图模型GPT-Image-2.5即将发布:Codex已经预埋发布页
动察 Beating AI 快讯,OpenAI 可能很快更新生图模型。社区研究者从最新版 Codex Desktop 前端里翻出了 imagegen-25-announcement-modal 和 imageGen25Announcement 等字符串,还强制唤出了隐藏弹窗。弹窗写着「图像创作迎来重大升级」,主打更高画质、更快生成和更智能的创作工具。