生数科技Vidu Q4冲进图生视频前三:前代还排第19
相关推荐
Claude杀入国产低价模型腹地:智谱、MiniMax盘中大跌
动察 Beating AI 快讯,Anthropic 新发布的 Claude Haiku 5.5,正在对国产低价模型形成「斩杀线」一般的竞争压力。10 月 8 日,港股大模型公司集体走弱,MiniMax 跌超 9%,智谱跌超 6%。同期恒生科技指数跌约 1%。 Haiku 5.5 的基础 API 输入价格为每百万 tokens 0.1 美元,输出为 0.5 美元。相比之下,DeepSeek V4.1 Flash 高峰时段分别收费 0.3 和 1.2 美元,闲时降至 0.15 和 0.6 美元。智谱 GLM-5.3 Flash 的标准价格为 0.15 和 0.5 美元。Haiku 5.5 在输入不超过 10 万 tokens 时,已经具备明显的单价竞争力。 Artificial Analysis 给 Haiku 5.5 的综合智能指数打出 43 分,超过 GLM-5.3 Flash 的 42 分、DeepSeek V4.1 Flash 的 39 分,以及小米 MiMo-V2.6-Flash 的 38 分。在 Terminal-Bench 4.0 编程评测中,Haiku 5.5 和 GLM-5.3 Flash 同为 33%,高于 DeepSeek 的 27% 和 MiMo 的 23%。 不过,Haiku 5.5 的优势主要体现在基础单价和最高推理强度下的成绩。它的 token 消耗较高,长上下文还会触发五倍定价。
MiniMax把OpenAI新Agents API做成开源版,Codex、Claude Code都能接
动察 Beating AI 快讯,MiniMax 开源 OpenAgentCore,做了一套兼容 OpenAI Agents API 的自托管实现。开发者可以继续使用 OpenAI 官方 SDK,只需要换掉 API 地址,后台运行的 Agent 可以选择 Codex、Claude Code 或 MiniMax Code。 Agents API 可以理解成一套「调用 Agent 的统一接口」。普通模型 API 主要负责一问一答。Agent 要连续干几个小时甚至几天,还要管理上下文、调用工具、协调子 Agent、保存任务进度。OpenAI 的 Agents API 把这些能力放到一个长期运行的 Session 里统一管理。 OpenAI 官方版本使用 OpenAI 托管的 Codex 执行框架。开发者可以自己选择代码在哪运行,但 Agent 的任务编排、上下文管理和运行状态仍由 OpenAI 负责。OpenAgentCore 则把这套后端也交给开发者自己部署。
MiniMax 推出新一代极速文本模型 M3.1-Flash-Preview
PANews 9月27日消息,MiniMax 公布其最新文本模型 M3.1-Flash-Preview,已在 MiniMax Code 正式上线。该模型定位为日常开发场景,官方称其在代码开发中可用于快速修复 bug 与实现完整功能,强调响应速度与稳定性。MiniMax 同时在 MiniMax Code 推出限时活动:自 9 月 28 日至 10 月 7 日(UTC+8),用户每日签到可获得 2 倍积分,适用于包括 M3.1-Flash-Preview 在内的代码模型,以及用于生成视频的 H3 模型。
沙特AI模型HUMAIN M3澄清模型底座基于MiniMax M3
动察 Beating AI 快讯,Max For AI 发文披露,沙特 AI 公司 HUMAIN 近日发布 HUMAIN M3,并最初将其称为「100% 沙特模型」。在受到质疑后,发布者 Sultan Alfaifi 澄清称,HUMAIN M3 基于中国 AI 公司 MiniMax 旗下 M3 模型开发。 HUMAIN M3 与 MiniMax M3 均采用混合专家架构,拥有 4280 亿个总参数和 230 亿个激活参数。HUMAIN 表示,其使用超过 1 万亿个阿拉伯语 Token 进行后训练,重点强化阿拉伯语、当地文化、智能代理、工具调用及电脑操作能力。 HUMAIN 称,该模型在 7 项阿拉伯语基准测试中的平均成绩为 89.37%,后续计划开放模型权重,并部署于沙特本土服务器。Max For AI 认为,此次合作显示中国模型正从提供 API 和产品,进一步成为其他国家构建主权 AI 体系的技术底座。
OpenRouter上线新匿名模型Space Bunny,多项指纹指向MiniMax M3.1
动察 Beating AI 快讯,OpenRouter 和 OpenCode 上线匿名模型 Space Bunny Alpha。它主打高速推理,支持可调推理强度、100 万 token 上下文,以及文本、图片和视频输入。OpenRouter 当前免费,OpenCode 则宣布限时免费一周。 社区很快把它指向尚未发布的 MiniMax M3.1。多名开发者用分词器、异常 token 和报错行为做模型「指纹」测试,结果均显示它与 MiniMax 模型高度接近。 MiniMax 官方开源的 MiniMax Code 仓库也已经提前出现 MiniMax-M3.1。测试代码中写有 100 万 token 上下文,以及 low、high、max 多档推理强度,与 Space Bunny 公布的特征高度重合。目前 MiniMax 尚未确认 Space Bunny 的真实身份。
Jev开始管Attention,MiniMax H3生成时间砍掉41.7%
动察 Beating AI 快讯,日本开发者 Kamimoto 把 Jev 接进 MiniMax H3 的视频生成流程。它会根据每一层的运行状态,从 1%、3%、5%、10% 四档里选择 Attention 保留多少,再由 Sparse Attention 决定具体哪些计算可以省掉。 在 RTX 4070 12GB 上,同样生成一段约 5 秒的视频,原版 4-step 方案需要 6 分 07 秒,加入 Sparse Attention + Jev 动态控制后降到 3 分 34 秒,总耗时缩短 41.7%。 不过,这 41.7% 不能全算在 Jev 头上。Sparse Attention 本身就能通过少算一部分 Attention 来提速,固定保留 5% 或 10% 也会变快。Jev 做的是动态调节:重要的层多算一点,不重要的层少算一点。 目前还不能证明这种动态调节一定比固定比例画质更好,作者也明确表示质量还没有充分验证。实验代码已经开源。