返回 7*24 快讯
来源Blockbeats

Critini分析师:Token价格战已经触底,中国AI「开源」玩家正在涨价或转向闭源

据 动察 Beating监测,Critini Research 分析师 Jukan 表示,中国的 AI「开源」玩家们也在涨价,或者逐渐转向更加闭源的模式。认为中国的 Token 价格战已经触底。GLM-5.2 背后的智谱今年也已经多次涨价。中国的大模型开发者不可能永远无视投资回报率,开源并不等于廉价的 API 定价。 --------------------------------- 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-14 08:58

OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API

据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。

07-29 21:18

Critini Research分析师:韩国监管今晚公布的维稳政策「令人失望」

BlockBeats 消息,7 月 29 日,Critini Research 韩裔分析师 Jukan 点评韩国监管今晚公布的维稳政策,称「这些措施令人深感失望。不过是象征性的、作秀式的姿态,几乎没有任何实际价值。」 Jukan 对监管层发出质问称「这些产品当初为什么被允许存在?即便政府阻止新资金流入,现有的持仓仍将面临清算压力,不是吗?他们真的认为教育就能解决这个问题吗?」

07-13 16:30

韩国AI遭Critini分析师泼冷水:创业公司和高校研究都被严重高估

据动察 Beating 监测,Critini Research 分析师 Jukan 在参加 ICML 后发文称,韩国只是在「假装认真发展 AI」。韩国 AI 创业公司和高校研究被严重高估,与中国相比「几乎什么都不是」。 他建议韩国推出类似中国「千人计划」的人才政策,吸引海外韩裔研究者回国,并主动挖走外国顶尖人才。否则,韩国可能沦为依赖外国 AI 技术的国家。

08-15 14:05

Claude Code官方省Token指南:11个技巧让额度用得更久

据动察 Beating 监测,Anthropic 发布 Claude Code 省 Token 指南。核心就一句:上下文越长,后面每一轮越贵。聊天、文件和命令输出都会继续占用 Token,也会因此更快消耗额度。 整理下来,有 11 个最实用的技巧: 1. 换任务就 /clear。一个任务做完就清掉上下文。还在做同一个任务,只是前面的内容没用了,再用 /compact 压缩。长会话越往后越贵,因为每一轮都会重新带上之前的内容。 2. 模型和 effort 开局就选好。中途执行 /model 或 /effort 会打掉 prompt cache(提示词缓存),下一轮需要重新处理整段上下文。Fast mode 也是一样,最好一开始就开。 3. 离开前先 /compact。订阅用户的缓存约 1 小时过期,API Key 默认约 5 分钟。缓存过期后再回来,下一轮通常要重新处理整个上下文。趁缓存还在时压缩更便宜。 4. 最近几轮跑偏就 /rewind。它只删掉后面几轮,前面的缓存还能继续用。/compact 会重写整个对话,成本更高。 5. 文件直接用 @ 文件名。Claude 会在第一轮直接拿到文件,可以省掉一次 Read 或搜索。一个文件通常只需要 @ 一次,重复 @ 反而可能把同一文件再塞一份进上下文。 6. Prompt 尽量说具体。与其说「测试挂了」,不如直接告诉 Claude 哪个测试、哪个文件。否则它可能先 grep、搜索、读一堆文件,这些结果之后每一轮都会继续占上下文。 7. 测试和日志尽量少输出。Build、测试、git log 的输出都会留在上下文。可以加 quiet 参数、只输出错误,或者用 tail 截断。Claude Code 对超过 3 万字符的命令输出反而会自动写入文件,只把摘要和路径留在会话里。 8. 用 /context 查启动负担。新会话一开始就可以看 CLAUDE.md、MCP 和工具定义占了多少上下文。CLAUDE.md 只放通用规则,专项流程放进按需加载的 Skill,不用的 MCP 用 /mcp 关掉。 9. 简单任务用更小的模型、更低的 effort。大模型输入和输出都更贵,thinking 也属于输出 Token。纯执行类任务没必要一直用最高档模型和最高推理强度。 10. 大日志交给 subagent,小任务别滥用。Subagent 有独立上下文,只把最终结果带回主会话,适合读大量日志、搜索文档。但它也要重新读文件、自己跑多轮,小任务反而可能更贵。搜索、读日志这类任务还可以指定 Haiku 或 Sonnet。 11. /loop 最好单独开会话。每次循环都是完整的一轮,会重复携带当前会话的全部上下文。如果间隔超过缓存时间,还可能叠加一次缓存失效。官方建议另开终端,用一个干净会话专门跑循环。 Anthropic 的建议归根结底就是:少塞无用内容,任务结束及时清,会话别拖得太长。

08-12 21:18

B.AI 平台推出 GLM-5.2 旗舰模型限时优惠活动

ChainCatcher 消息,B.AI 平台现面向所有用户推出 GLM-5.2 模型限时 6 折优惠。 活动期间,无论通过 API 进行工程化部署,还是在 Web 端进行日常交互,全量调用均可享受 6 折结算价。折扣后价格分别为:输入 0.84、缓存写入 0.84、缓存读取 0.168、输出 2.64(单位:Credits/Token)。 GLM-5.2 作为新一代开源旗舰模型,拥有 1M 超长上下文窗口,专为大规模代码开发、复杂推理及智能体任务等高性能场景设计。用户可通过官方 API 标准通道或网页端直接使用,全场景工作流实现无缝衔接。此次活动旨在以更低成本释放顶级 AI 生产力,即日起用户可登录 B.AI 平台体验。

08-10 22:29重要

智谱API用户近700万,新启用超5万块国产AI芯片缓解算力压力

BlockBeats 消息,8 月 10 日,据《晚点 LatePost》报道,智谱 MaaS 开放平台注册用户规模已接近 700 万,较 7 月初增长约 200 万,其中企业客户数量达到 2.3 万家。其开发者产品 ZCode 上线一个月用户突破 100 万。 报道称,智谱今年以来 ARR(年度经常性收入)增长约 15 倍。市场人士透露,智谱当前 ARR 可能达到 20 亿美元,但该数据尚未获官方确认。 随着模型调用需求快速增长,智谱正在扩大国产算力基础设施。据了解,智谱已启用超过 5 万块国产 AI 算力芯片,以缓解日益增长的推理需求。此前市场传闻智谱已建设规模达 1GW 的国产 AI 算力基础设施。 智谱增长主要受编程场景需求爆发推动。GLM-5 模型发布后,公司 ARR 快速增长,目前 API 业务成为核心收入来源。智谱同时持续优化推理效率,通过 KV 缓存拆分、推理网络架构等技术提升算力利用率。 此外,智谱 7 月推出高速版 API,每秒生成 Token 数量达到 400,相比常规 API 速度提升约 8 倍;7 月 31 日,公司重新开放 Coding Plan 购买,并大幅调整价格,Lite 版本月费升至 118 元。 行业人士认为,随着 AI 编程需求持续增长,推理效率优化将成为大模型公司的核心竞争力。谁能在相同算力下生成更多 Token,谁将在成本和商业化方面占据优势。 目前,智谱、Kimi、DeepSeek 等中国大模型企业均面临算力瓶颈与模型竞争压力,市场预计多家公司将在 8 月推出新一代模型,AI 大模型竞争将进一步加剧。