MiniMax半年收入已超去年全年:企业和开发者调用模型撑起六成
相关推荐
OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API
据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。
天猫上线Token充值中心,首批接入阿里云、智谱、Kimi、MiniMax
火星财经消息,9月3日,天猫正式上线AI 空间站( Token充值中心)。页面显示,该充值中心集合了阿里云、智谱、Kimi、MiniMax等国内大模型厂商的订阅服务,在售商品包括按周期订阅的Token Plan、Coding Plan以及按用量付费的充值方案,支持卡密或直充两种交付方式。
沙特AI模型HUMAIN M3澄清模型底座基于MiniMax M3
动察 Beating AI 快讯,Max For AI 发文披露,沙特 AI 公司 HUMAIN 近日发布 HUMAIN M3,并最初将其称为「100% 沙特模型」。在受到质疑后,发布者 Sultan Alfaifi 澄清称,HUMAIN M3 基于中国 AI 公司 MiniMax 旗下 M3 模型开发。 HUMAIN M3 与 MiniMax M3 均采用混合专家架构,拥有 4280 亿个总参数和 230 亿个激活参数。HUMAIN 表示,其使用超过 1 万亿个阿拉伯语 Token 进行后训练,重点强化阿拉伯语、当地文化、智能代理、工具调用及电脑操作能力。 HUMAIN 称,该模型在 7 项阿拉伯语基准测试中的平均成绩为 89.37%,后续计划开放模型权重,并部署于沙特本土服务器。Max For AI 认为,此次合作显示中国模型正从提供 API 和产品,进一步成为其他国家构建主权 AI 体系的技术底座。
MiniMax修订与阿里巴巴签订的API及云服务协议年度上限
Odaily星球日报讯 据官方公告,MiniMax 修订与阿里巴巴签订的 API 及云服务协议年度上限。
MiniMax 7月Token消耗量飙至年初20倍 8月ARR冲破8亿美元
火星财经消息,MiniMax 8月26日晚在2026年中期业绩会上披露,公司8月年度经常性收入(ARR)已超过8亿美元,第二季度收入较第一季度环比增长81.8%,7月Token消耗量已达到1月的20倍,B端业务在整体ARR中的贡献已超过80%。MiniMax称,在算力上,公司是国内最早建立规模化、长期稳定基础设施体系的两家独立大模型公司之一。基础设施已能独立支撑最大的训练任务,ETTR(EffectiveTrainingTimeRatio,有效训练时间比例)已经达到97%。(财联社)
AI开始影响考勤:有公司为省Token让程序员倒班,以降低高峰时段额度消耗
动察 Beating AI 快讯,一家十来人的创业公司开始让程序员倒班,原因不是服务器要 24 小时值守,而是想省 AI Token。员工在 V2EX 发帖称,公司大量使用 DeepSeek、智谱等 Coding 服务,模型在部分高峰时段收费或额度消耗更高,公司索性开始跟着便宜时段排班。 新考勤要求员工每周工作日休一天、周末再休一天,可以自由组合,但要提前排班。工作日午休也被推迟到 14:00 以后。发帖人随后透露,公司只有十来个人,目前同时购买了 MiniMax、GLM、DeepSeek 和火山引擎等多套 Coding Plan。 DeepSeek 新一轮 API 定价把工作日高峰价定为低谷价的两倍,8 月 23 日又把周末改成全天低谷价。智谱的 Coding Plan 也按时间算额度,非高峰时段内,模型调用按基础积分消耗的 50% 抵扣。 原帖下面有人吐槽,人类居然开始主动配合 AI 的价格时段工作;也有网友称,自己公司的老板已经听说类似做法,还在考虑要不要跟。