中国AI大模型调用量连续二十周领跑
相关推荐
花旗:OpenRouter 开源模型 Token 占比飙升至 65%,中美模型价差达数十倍
火星财经消息,据路透社报道,花旗银行(Citi)最新发布的数据显示,受企业削减 AI 支出的需求驱动,低成本开源模型的市场采用率正快速上升。今年 6 月,在 AI 聚合平台 OpenRouter 上处理的开源模型 Token 比例已从 1 月份的 34% 跃升至 65%。花旗在报告中特别指出成本差异是推动这一趋势的核心因素。数据显示,部分中国开源大模型在不断缩小与美国头部模型性能差距的同时,其每百万 Token 的收费低至 18 美分,而当前行业头部大模型的平均收费约为 4 美元,两者成本差距超过 20 倍。
智谱Token推理成本较年初降80%:10万张国产芯片跑大模型
动察 Beating AI 快讯,智谱披露,公司目前已经实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。 这批国产算力此前已经露过面。智谱发布 GLM-5.3-Flash 时曾确认,该模型的全部线上流量由 10 万张国产芯片承载。发布前,匿名模型 Ox-Alpha 在 OpenRouter、OpenCode 上的大规模测试,同样跑在这批国产算力上。
匿名模型“牛来”刷新OpenRouter纪录 技术线索被指关联GLM
火星财经消息,近日,代号Ox‑Alpha的匿名模型上线大模型聚合平台OpenRouter,被中文社区称作“牛来”模型。该模型支持百万Token上下文与多模态输入,上线首日调用量登顶平台并刷新单日纪录,其还在OpenCode平台终结DeepSeek长达56天的榜首位置。OpenCode官方公告称,该模型背后提供方每天拥有100万亿(100T)tokens的算力。目前初步技术线索猜测其或与GLM系列有关,《科创板日报》记者向智谱求证,暂未获回应。 (科创板日报记者 李明明)
神秘大模型 Ox Alpha 登陆 OpenRouter,限时免费一周
PANews 8月21日消息,一款名为 Ox Alpha 的高性能“隐身”大模型今日上线 OpenRouter,支持最高100万token上下文窗口,并可处理文本、图像与视频多模态输入。该模型将在一周内向用户免费开放。目前尚无任何AI实验室或公司对其归属“认领”,模型开发方及真实身份仍未公开。
DeepSeek Flash 涨价后流量腰斩,留下近 10 万亿 Token 日缺口
火星财经消息,OpenCode CEO Jay V 表示,DeepSeek V4 Flash 自 8 月 1 日上线后,在 OpenCode 上的日 Token 消耗量从约 3 万亿飙升至 18 万亿,两周内增长 6 倍,接近 OpenRouter 全平台日处理量。其定价约为 Fable 的 1/350、GPT-5.6 Sol 的 1/175、Claude Sonnet 的 1/70,被用户视为“便宜到无需计量的 AI”。8 月 16 日 DeepSeek 将高峰时段价格上调 5 倍(非高峰时段 2.5 倍)后,模型日 Token 消耗量从峰值回落超过 50%。Jay V 认为涨价系应对 GPU 成本上升的被动之举。目前 OpenCode 正寻找能以原价承接流量的供应商,约需 1000 块 B300 才能支撑当前需求。DeepSeek Flash 暴露了 AI 模型市场的“不可能三角”——便宜、强大、大规模稳定供应难以兼得。涨价后,OpenCode Go 已将配额从 60 美元降至 15 美元后又恢复至 30 美元,并引入峰谷费率机制。
「牛来」模型 ?OpenRouter又放匿名模型,Ox Alpha疑似小米MiMo新模型
动察 Beating AI 快讯,OpenRouter 上线新匿名模型 Ox Alpha,定位为面向代码、长时间 Agent 工作和真实生产环境的前沿模型,支持 100 万 Token 上下文,并支持文本、图片、视频输入。目前模型免费开放测试,提供方不会使用用户的 prompt 和输出训练模型。 Ox Alpha 的身份暂未公开,但社区普遍猜测它可能来自小米 MiMo 团队。小米 CFO 林世伟此前也透露,新一代 MiMo 模型正在训练中,有望很快发布。 在 OpenRouter 上匿名放新模型已经快成中国模型厂商的固定节目。此前智谱的 GLM-5、小米的 MiMo-V2-Pro 和 MiMo-V2-Omni、蚂蚁的 Ling-2.6-flash、美团的 LongCat-2.0,都曾先换个名字在 OpenRouter 免费跑一轮,再公开真实身份。