返回 7*24 快讯
来源MarsBit

杰富瑞:中国AI进入Token消耗扩张期,低成本模型重塑竞争格局

火星财经消息,6 月 23 日,杰富瑞在 6 月 22 日发布的 AI 系列报告中称,随着代码、Agent、办公和内容生成场景加速普及,AI 使用正在从「聊天」转向「工作流」,推动 Token 消耗快速增长。OpenRouter 数据显示,截至 6 月 22 日前一周,平台 Token 消耗环比增长 4.7%,达到 46.7 万亿。 在这一趋势中,中国模型的份额正在扩大。报告称,在 OpenRouter 口径下,中国模型当周 Token 消耗为 18.8 万亿,高于美国模型的 5.8 万亿。DeepSeek V4 Flash 以 4.94 万亿 Token 排名第一,其后是小米 MiMo-V2.5、MiniMax M3 和腾讯 Hy3 preview。 这一变化背后,是中国模型在性能和成本之间取得更具竞争力的平衡。杰富瑞称,中国模型与美国模型的智能差距正在收窄,而 API 调用成本仅为美国模型的一小部分。报告将这种成本优势归因于 MoE、注意力机制优化以及更高的模型算力利用率。 不过,Token 使用量上升并不意味着支出同步上升。杰富瑞的 Silicon Data LLM Token Expenditure Index 在 6 月 14 日至 19 日期间维持在 1.64 至 1.68,低于 5 月 31 日的 2.04,显示企业和开发者在扩大调用量的同时,也在转向更便宜、更高效的模型。 杰富瑞认为,这种「更多调用、更低单价」的组合将利好百度、阿里巴巴、腾讯、金山云、AI Labs 以及快手可灵等公司。云服务商将受益于模型调用和 MaaS 需求增长,AI 应用则有望在代码、Agent、办公软件和中长内容生成中找到更明确的商业化路径。 报告特别提到,火山引擎即将举行 FORCE 大会,市场将关注豆包大模型日 Token 消耗、订阅套餐定价、Seedance 2.0、TRAE、Arkclaw、Coze 等代码和 Agent 产品进展,以及 MaaS 收入目标。腾讯方面,微信 AI「小微」正在小规模测试,杰富瑞预计其可能在 2026 年第四季度正式发布。 应用端的用户基础也在扩大。5 月全球 AI 移动应用月活排名中,ChatGPT 仍以约 9.58 亿位居第一,但中国应用已占据多个前列位置,包括豆包、Qwen、夸克、DeepSeek 和元宝。报告认为,中国 AI 应用下一阶段的关键,将从用户增长转向高频场景渗透和商业化。 长期来看,杰富瑞引用 F&S 和 CAICT 数据称,中国大模型市场预计 2024 年至 2030 年复合增长率约为 64%,到 2030 年规模将超过 1000 亿元人民币。企业端和本地部署预计将成为主要收入来源。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-05 10:12

DeepSeek把谷歌挤下榜首,拿下OpenRouter本周调用量第一

据动察 Beating 监测,模型聚合平台 OpenRouter 数据显示,DeepSeek 文本请求量本周已达到 2.99 亿次,占平台总量的 27.1%,超过此前长期领先的谷歌。谷歌同期为 2.77 亿次、25.0%,OpenAI 以 1.85 亿次、16.8% 排名第三。 这个榜单按模型厂商合并统计文本 API 请求次数。DeepSeek V4 Flash、V4 Pro 等模型产生的调用,都会记入 DeepSeek 名下。 DeepSeek 的增长主要由 V4 系列推动。OpenRouter 此前披露,V4 发布后,DeepSeek 的 Token 份额半年内大致翻倍,增长主要来自 Agent 任务。V4 Flash 上线一个月后,已占 DeepSeek Agent Token 用量的 70%。Agent 完成一次任务往往会连续调用模型多次,也更容易推高请求量。

08-03 16:36

DeepSeek V4Flash在OpenCode爆量:单日跑掉8万亿Token

据动察 Beating 监测,AI 编程工具 OpenCode 披露,接入 DeepSeek V4 Flash 当天,OpenCode 用户跑了 8 万亿个 Token,其中 5 万亿来自免费计划,3 万亿来自付费订阅 OpenCode Go。 过去一周,它已占 OpenCode 全部 Token 用量的 55%,排名第一。

08-13 15:14

「韩模之光」Solar Pro4智能指数冲到42分,但还是打不过DeepSeek V4Flash

据动察 Beating 监测,韩国 AI 公司 Upstage 发布旗舰推理模型 Solar Pro 4。Artificial Analysis 最新评测中,它的智能指数从上一代 Solar Pro 3 的 14 分冲到 42 分,主要提升来自 Agent 和长上下文能力。 其中 Terminal-Bench v2.1 从 12% 升到 57%,长上下文推理从 31 升到 71。GDPval-AA v2 也从 498 Elo 升到 1277,超过 1000 的人类基线。Solar Pro 4 已经是韩国模型冲击全球前列的一张代表牌。 但放到 DeepSeek V4 Flash 0731 面前,还是不够看。同一套 Artificial Analysis 智能指数里,DeepSeek 拿到 52 分,比 Solar Pro 4 高 10 分。DeepSeek 每秒输出约 122 个 Token,Solar Pro 4 约 65 个,前者接近快一倍。 价格差距更大。Solar Pro 4 每百万 Token 输入、输出分别要 0.30 和 1.20 美元,DeepSeek 只要 0.14 和 0.28 美元。Solar 的输出价格超过 DeepSeek 的 4 倍。 至少按这套综合评测和 API 性价比,「韩模之光」还没追上 DeepSeek。

08-10 10:33

中国AI大模型调用量连续十五周领跑:环比增长570% DeepSeek-V4-Flash正式版登顶

火星财经消息,根据OpenRouter最新数据测算,上周(8月3日至8月9日)全球AI大模型总调用量为69万亿Token,环比增长21.48%。其中,上榜的AI大模型中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位。记者注意到,上周,全球调用量排名前四均为中国AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第一,周调用量达8.83万亿Token,环比增长570%;腾讯Hy3位居第二,周调用量达8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排名第三,周调用量达5.88万亿Token,环比下滑19%。 (每日经济新闻)

08-01 11:37

DeepSeek没把新版能力锁在API,V4-Flash正式版权重开源

据动察 Beating 监测,DeepSeek 已在 Hugging Face 放出 V4-Flash-0731 正式版权重,并继续采用 MIT 许可证。开发者可以自行部署、微调和商用,不必只能通过 DeepSeek 官方 API 使用。 这次开放的是刚完成后训练升级的正式版。它在多项 Agent 测试中超过 V4-Pro-Preview,相关能力现在也能由第三方独立部署和复测。

08-13 20:52

DeepSeek Harness正式上线:首款Agent产品,整个Agent可实现自行组装

据 动察 Beating 监测,DeepSeek 正式上线首款 Agent 产品 DeepSeek Harness,软件包已经发布至 npm。此前 V4-Flash 的公开 Code Agent 评测,用的就是 Harness 内置的极简模式。 它不只是一款类似 Codex 的 Coding Agent。Harness 支持管理项目、长任务、多 Agent、Skill、联网搜索和上下文管理,还允许用户创建不同的「Agent 预设」。写代码、研究、写作等任务,可以配置不同的工具、提示词和工作方式。 更特别的是插件系统。DeepSeek 把「Everything is a plugin」作为核心设计,模型、工具、提示词、存储、上下文甚至界面都能通过插件替换或组合。内测用户已经做出了长期记忆、界面修改等插件。 简单说,Codex 更像一个做好的 Agent,DeepSeek Harness 更像一套组装 Agent 的运行时。用户不只是在选模型,也可以自己决定 Agent 用什么工具、遵守什么规则、怎么工作。