返回 7*24 快讯
来源MarsBit

DeepSeek Flash 涨价后流量腰斩,留下近 10 万亿 Token 日缺口

火星财经消息,OpenCode CEO Jay V 表示,DeepSeek V4 Flash 自 8 月 1 日上线后,在 OpenCode 上的日 Token 消耗量从约 3 万亿飙升至 18 万亿,两周内增长 6 倍,接近 OpenRouter 全平台日处理量。其定价约为 Fable 的 1/350、GPT-5.6 Sol 的 1/175、Claude Sonnet 的 1/70,被用户视为“便宜到无需计量的 AI”。8 月 16 日 DeepSeek 将高峰时段价格上调 5 倍(非高峰时段 2.5 倍)后,模型日 Token 消耗量从峰值回落超过 50%。Jay V 认为涨价系应对 GPU 成本上升的被动之举。目前 OpenCode 正寻找能以原价承接流量的供应商,约需 1000 块 B300 才能支撑当前需求。DeepSeek Flash 暴露了 AI 模型市场的“不可能三角”——便宜、强大、大规模稳定供应难以兼得。涨价后,OpenCode Go 已将配额从 60 美元降至 15 美元后又恢复至 30 美元,并引入峰谷费率机制。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-03 16:36

DeepSeek V4Flash在OpenCode爆量:单日跑掉8万亿Token

据动察 Beating 监测,AI 编程工具 OpenCode 披露,接入 DeepSeek V4 Flash 当天,OpenCode 用户跑了 8 万亿个 Token,其中 5 万亿来自免费计划,3 万亿来自付费订阅 OpenCode Go。 过去一周,它已占 OpenCode 全部 Token 用量的 55%,排名第一。

08-04 16:19

DeepSeek便宜到离谱:OpenCode两个月狂跑90万亿Token,账单仅92万美元

据 动察 Beating 监测,AI 编程工具 OpenCode 数据显示,6 月 10 日至 8 月 4 日,DeepSeek V4 Flash 在 OpenCode Go 上累计处理 90 万亿个 Token,总支出约 91.7 万美元。平均每 1 亿 Token 只需约 1.02 美元。 低成本主要来自缓存。该模型 96% 的输入 Token 命中缓存,平均每次会话处理 870 万个 Token,成本仅约 0.09 美元。

08-18 22:49重要

B.AI 平台免费开放 DeepSeek V4 Flash,Token 吞吐量突破 769 亿

ChainCatcher 消息,B.AI 平台自开放 DeepSeek V4 Flash 免费访问以来,最新 24 小时数据出炉:Token 吞吐量突破 769 亿,累计新增注册用户达 206 万,单日新注册峰值录得 5468 人。B.AI 平台凭借稳定高并发基础设施,开发者可零成本调用顶级 LLM 聚合服务,支撑生产级 AI 工作流。 目前,网页聊天与 API 接口已同步解锁,开发者即日起即可零门槛接入,开启从原型验证到大规模部署的全链路 AI 开发体验。B.AI 正以“免费+高性能”的组合拳,加速重构大模型服务市场格局。

08-16 08:29

DHH横测编程模型:DeepSeek23美元跑完,Fable约550美元

据动察 Beating 监测,Ruby on Rails 作者 DHH 用同一个 Python 转 Rust 任务测试多款模型。DeepSeek Pro V4 Max 最终完成,用时约 2.5 小时,总 Token 成本 23 美元。Grok 4.6 花了 55 美元、约 1.5 小时,GPT-5.6 Sol 花了 43 美元;DeepSeek V4 Flash 和 GPT-5.6 Luna 没能完成。 最初一轮由 Fable 主导,DHH 统计成本约 550 美元、耗时约 45 分钟。它把 TerminalTextEffects 从 Python 重写成 Rust,共用了约 1100 万 Token。启动时间从 87ms 降到 2ms,渲染速度提高 9.6 倍。 不过对比有个前提。Fable 先写了一份 483 行的实施方案,Codex xhigh 审核后,其他模型都直接沿用了这份方案。因此这里更像是在比较不同模型执行同一方案的成本和效率。 项目已经开源。仓库包含 354 项一致性测试,会逐帧、逐字节比较 Rust 版和 Python 原版,最终产物可编译成约 3.3MB 的静态单文件。

08-10 10:33

中国AI大模型调用量连续十五周领跑:环比增长570% DeepSeek-V4-Flash正式版登顶

火星财经消息,根据OpenRouter最新数据测算,上周(8月3日至8月9日)全球AI大模型总调用量为69万亿Token,环比增长21.48%。其中,上榜的AI大模型中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位。记者注意到,上周,全球调用量排名前四均为中国AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第一,周调用量达8.83万亿Token,环比增长570%;腾讯Hy3位居第二,周调用量达8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排名第三,周调用量达5.88万亿Token,环比下滑19%。 (每日经济新闻)

08-05 10:12

DeepSeek把谷歌挤下榜首,拿下OpenRouter本周调用量第一

据动察 Beating 监测,模型聚合平台 OpenRouter 数据显示,DeepSeek 文本请求量本周已达到 2.99 亿次,占平台总量的 27.1%,超过此前长期领先的谷歌。谷歌同期为 2.77 亿次、25.0%,OpenAI 以 1.85 亿次、16.8% 排名第三。 这个榜单按模型厂商合并统计文本 API 请求次数。DeepSeek V4 Flash、V4 Pro 等模型产生的调用,都会记入 DeepSeek 名下。 DeepSeek 的增长主要由 V4 系列推动。OpenRouter 此前披露,V4 发布后,DeepSeek 的 Token 份额半年内大致翻倍,增长主要来自 Agent 任务。V4 Flash 上线一个月后,已占 DeepSeek Agent Token 用量的 70%。Agent 完成一次任务往往会连续调用模型多次,也更容易推高请求量。