智谱API涨价一倍还越用越猛:调用量涨40倍,大客户涨98倍
相关推荐
智谱上半年实现收入9.54亿元,MaaS开放平台及API业务占比近九成
PANews 8月31日消息,据智谱(02513)披露的2026年上半年业绩,实现收入9.54亿元,同比增长近400%。其中,MaaS开放平台及API业务收入8.25亿元,同比增长约2736%,占总收入近九成。用户方面,智谱MaaS平台企业及开发者用户数量已超过740万,Token调用量较年初增长超40倍。在基础设施层面,智谱已形成10万级国产芯片规模化推理能力,单位Token推理成本较年初下降80%,构建“自主模型—国产算力—规模化应用”的完整链路,并通过GLM-5.3-Flash提升智能与成本效率。
千问App与PC端上线阿里云Token Plan接入功能
火星财经消息,据千问App公众号,今天,千问App与PC端上线阿里云Token Plan接入功能,支持绑定API Key后使用Token Plan额度处理复杂任务。
AI开始影响考勤:有公司为省Token让程序员倒班,以降低高峰时段额度消耗
动察 Beating AI 快讯,一家十来人的创业公司开始让程序员倒班,原因不是服务器要 24 小时值守,而是想省 AI Token。员工在 V2EX 发帖称,公司大量使用 DeepSeek、智谱等 Coding 服务,模型在部分高峰时段收费或额度消耗更高,公司索性开始跟着便宜时段排班。 新考勤要求员工每周工作日休一天、周末再休一天,可以自由组合,但要提前排班。工作日午休也被推迟到 14:00 以后。发帖人随后透露,公司只有十来个人,目前同时购买了 MiniMax、GLM、DeepSeek 和火山引擎等多套 Coding Plan。 DeepSeek 新一轮 API 定价把工作日高峰价定为低谷价的两倍,8 月 23 日又把周末改成全天低谷价。智谱的 Coding Plan 也按时间算额度,非高峰时段内,模型调用按基础积分消耗的 50% 抵扣。 原帖下面有人吐槽,人类居然开始主动配合 AI 的价格时段工作;也有网友称,自己公司的老板已经听说类似做法,还在考虑要不要跟。
OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API
据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。
智谱API用户近700万,新启用超5万块国产AI芯片缓解算力压力
BlockBeats 消息,8 月 10 日,据《晚点 LatePost》报道,智谱 MaaS 开放平台注册用户规模已接近 700 万,较 7 月初增长约 200 万,其中企业客户数量达到 2.3 万家。其开发者产品 ZCode 上线一个月用户突破 100 万。 报道称,智谱今年以来 ARR(年度经常性收入)增长约 15 倍。市场人士透露,智谱当前 ARR 可能达到 20 亿美元,但该数据尚未获官方确认。 随着模型调用需求快速增长,智谱正在扩大国产算力基础设施。据了解,智谱已启用超过 5 万块国产 AI 算力芯片,以缓解日益增长的推理需求。此前市场传闻智谱已建设规模达 1GW 的国产 AI 算力基础设施。 智谱增长主要受编程场景需求爆发推动。GLM-5 模型发布后,公司 ARR 快速增长,目前 API 业务成为核心收入来源。智谱同时持续优化推理效率,通过 KV 缓存拆分、推理网络架构等技术提升算力利用率。 此外,智谱 7 月推出高速版 API,每秒生成 Token 数量达到 400,相比常规 API 速度提升约 8 倍;7 月 31 日,公司重新开放 Coding Plan 购买,并大幅调整价格,Lite 版本月费升至 118 元。 行业人士认为,随着 AI 编程需求持续增长,推理效率优化将成为大模型公司的核心竞争力。谁能在相同算力下生成更多 Token,谁将在成本和商业化方面占据优势。 目前,智谱、Kimi、DeepSeek 等中国大模型企业均面临算力瓶颈与模型竞争压力,市场预计多家公司将在 8 月推出新一代模型,AI 大模型竞争将进一步加剧。
英伟达给Pi加外挂:Agent自己研究找出4种优化,Token最高省64%
动察 Beating AI 快讯,英伟达 NVLabs 开源 SoL-Pi,给 Coding Agent Harness「Pi」加了一层效率优化。研究团队搭了一套自动研究流程,让多个 Agent 分析 Pi 的运行轨迹、提出优化方案、改代码并自动验证。最初有 152 个候选方向,最后只留下 4 个。 这 4 个优化都在减少重复开销。比如改完代码后直接接着跑测试,少一次模型调用;读过的大文件和长输出先存到本地,需要时再取;子任务结束后判断要不要压缩上下文;超长日志先交给便宜模型筛重点,再核对内容确实来自原日志。 在 EdgeBench 上,SoL-Pi 相比原版 Pi 少用 45%–49% Token,成本低约三分之一;相比 Codex、Claude Code 的原生 Harness,Token 少 35%–64%,按 API 标价计算成本低 50%–54%。 不过省钱会损失一点能力,SoL-Pi 保留了 Pi 约 94% 的平均得分;在 Terminal-Bench 4 的 63 个 CPU 任务里,它解出 15 个,Codex 和 Pi 都是 18 个。