中国AI大模型调用量连续二十二周领跑
相关推荐
OpenRouter上线匿名大模型Space Bunny Alpha,支持100万Token上下文并免费开放
PANews 9月26日消息,据OpenRouter模型页,匿名大模型Space Bunny Alpha已于9月23日上线预览,主打高速推理和代码能力,支持可调节推理强度、原生多模态输入(文本、图像及视频)、工具调用、结构化输出以及100万Token上下文窗口,单次最多可输出524,288 Token。页面目前显示其输入与输出均免费。该模型由一家选择在预览期间保持匿名的第三方供应商开发和运营,OpenRouter仅负责请求路由,并非其开发者、所有者或提供商;用户提示词和模型输出可能由供应商保留,但不会用于训练。
AI模型聚合平台OpenRouter上线批量API,多数模型Token价格减半
PANews 9月23日消息,据OpenRouter在X平台发文称,其批量API(Batch API)已正式上线,面向无需即时返回结果的任务,大多数模型的每Token价格减半,所有结果将在24小时内返回。五折优惠同时适用于输入和输出Token,目前支持70余种模型。OpenRouter称,两周测试期间共完成逾23万个批次任务,完成时间中位数为7分钟,90%在1小时内完成。
TypeSafe AI与 OpenRouter 推出 Jev 智能路由器提升 LLM 调用效率
PANews 9月26日消息,TypeSafe AI在X上最新发帖称,OpenRouter 已集成 Jev 路由能力至全部 LLM 调用,通过 typesafe/jev-router 在每次请求时动态选择最优模型与推理强度,实现“cache-aware”的模型路由,以平衡质量、速度与成本。该路由器可根据上下文命中缓存,避免重复计算,减少无效 token 消耗,优化复杂 agent 工作流性能。部分开发者称,其在大规模真实样本评分任务中实现了近乎100%准确率,但也反映随着使用激增,响应时延有所上升。
OpenRouter上线新匿名模型Space Bunny,多项指纹指向MiniMax M3.1
动察 Beating AI 快讯,OpenRouter 和 OpenCode 上线匿名模型 Space Bunny Alpha。它主打高速推理,支持可调推理强度、100 万 token 上下文,以及文本、图片和视频输入。OpenRouter 当前免费,OpenCode 则宣布限时免费一周。 社区很快把它指向尚未发布的 MiniMax M3.1。多名开发者用分词器、异常 token 和报错行为做模型「指纹」测试,结果均显示它与 MiniMax 模型高度接近。 MiniMax 官方开源的 MiniMax Code 仓库也已经提前出现 MiniMax-M3.1。测试代码中写有 100 万 token 上下文,以及 low、high、max 多档推理强度,与 Space Bunny 公布的特征高度重合。目前 MiniMax 尚未确认 Space Bunny 的真实身份。
智谱Token推理成本较年初降80%:10万张国产芯片跑大模型
动察 Beating AI 快讯,智谱披露,公司目前已经实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。 这批国产算力此前已经露过面。智谱发布 GLM-5.3-Flash 时曾确认,该模型的全部线上流量由 10 万张国产芯片承载。发布前,匿名模型 Ox-Alpha 在 OpenRouter、OpenCode 上的大规模测试,同样跑在这批国产算力上。
匿名模型“牛来”刷新OpenRouter纪录 技术线索被指关联GLM
火星财经消息,近日,代号Ox‑Alpha的匿名模型上线大模型聚合平台OpenRouter,被中文社区称作“牛来”模型。该模型支持百万Token上下文与多模态输入,上线首日调用量登顶平台并刷新单日纪录,其还在OpenCode平台终结DeepSeek长达56天的榜首位置。OpenCode官方公告称,该模型背后提供方每天拥有100万亿(100T)tokens的算力。目前初步技术线索猜测其或与GLM系列有关,《科创板日报》记者向智谱求证,暂未获回应。 (科创板日报记者 李明明)