返回 7*24 快讯
来源MarsBit

中信建投:稳健者加大算力投入力度,应用飞轮闭环优于预期

火星财经消息,中信建投研报称,2026年以来,AI产业投资逻辑正从模型能力与资本开支竞赛,逐步转向订单、收入及盈利的商业化验证。海外Agent产品率先形成收入增量,云厂商高强度算力投入仍有云收入和在手订单支撑;国内模型在Coding及Agent任务上的能力差距快速收窄,推理效率、Token调用量及产品收入同步提升。展望未来一至两个季度,国产模型迭代、Agent产品升级和旗舰模型重新定价有望共同推进,建议持续关注算力服务、国产芯片与超节点,以及具备场景、数据和企业交付能力的B端AI应用厂商。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

07-23 10:31

梁文锋:现阶段最重要的是Coding Agent,长期目标仍是AGI

Odaily星球日报讯 Odaily 星球日报讯,据 "elsewhere "披露,其收集整理了 DeepSeek 创始人梁文锋在此前会议期间的 52 条言论。梁文锋表示,DeepSeek 当前只有一条主线,即通往 AGI 的技术路线,产品只是这一过程中的“副产物”,现阶段最重要的方向仍是 Coding Agent,之后将重点解决持续学习,再进一步实现 AI 自迭代,最终走向具身智能。 在商业化方面,梁文锋表示,DeepSeek 不追求利润最大化,只获取合理利润,开源和低价均属于“克制”战略的一部分,目的不是争夺更多市场份额,而是提高最终实现 AGI 的概率。他同时表示,DeepSeek 无意成为下一个超级 App,也不会将 3D、视频生成、世界模型等方向作为当前主线。 谈及大模型竞争,梁文锋认为,未来差距主要体现在成本、时间和用户体验,其中成本最重要。他还表示,保持团队稳定性是公司“唯一无法退让”的事项。

07-13 19:30重要

智谱害怕成为下一个MiniMax?内部信淡化Coding,全面押注AGI与Agent

BlockBeats 消息,7 月 13 日,智谱创始人唐杰发布内部信《巨浪已来》,提出未来将聚焦 Long Horizon Task(长周期任务)、Autonomous Agent(自主智能体)、Self-Evolving(自我演进)及 AGI 等方向,并启动未来两年的「Touch High(摸高)」计划,明确表示不追求短期应用变现。 报道称,尽管 AI Coding 业务曾推动智谱商业化快速增长和估值提升,但唐杰在内部信中几乎未提及 Coding,而是将公司定位进一步转向 AGI 基础设施与自主智能体路线。分析认为,此举意在避免市场以传统 SaaS 或 AI 应用公司的收入、ARR 等指标对智谱进行估值,而是继续维持 AGI 技术公司的长期成长叙事。 市场观点认为,在 MiniMax 解禁后股价大幅回调、AI 公司估值逻辑逐渐从「技术预期」转向「商业兑现」的背景下,智谱正试图提前完成资本市场叙事切换,以技术突破和 AGI 愿景作为新的估值锚点。 --------------------------------- 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。

07-01 00:31

Pump.fun调整功能策略:将不再支持Tokenized Agent发行

Odaily星球日报讯 Pump.fun 在 X 平台发文表示,将停止支持 Tokenized Agent(代币化 AI Agent)发行功能,但已在发行时启用该功能的现有代币将不受影响。Pump.fun 称,未来将重点转向“能够显著提升散户交易体验”的发行模式,以优化用户在代币上线阶段的整体交互与交易流程,该调整或意味着 Pump.fun 在 Meme 币 发射机制设计上可能有进一步收敛,转向更强调可用性与交易体验的产品方向,而非扩展既有功能的覆盖范围。

08-16 09:02

ZCode免费送1亿GLM-5.3 Token,太火导致上线一小时就暂停

据动察 Beating 监测,智谱旗下编程 Agent 工具 ZCode,给 GLM-5.3 推出了一场周末免费活动。新用户首次登录 ZCode,即可获得 1 亿 GLM-5.3 Token,用于 AI 编程、代码修改和 Agent 任务。 活动原定北京时间 8 月 16 日 0 点开始,持续到 17 日上午 9 点。结果上线一小时,ZCode 就宣布暂停新增 1 亿 Token 发放。官方称活动需求「超出预期」,正在调整服务容量。 已经领取的额度不受影响,普通新用户的 300 万 GLM-5.3 Token 福利仍然开放。ZCode 表示,等容量恢复后会重新开启 1 亿 Token 活动。

08-15 14:05

Claude Code官方省Token指南:11个技巧让额度用得更久

据动察 Beating 监测,Anthropic 发布 Claude Code 省 Token 指南。核心就一句:上下文越长,后面每一轮越贵。聊天、文件和命令输出都会继续占用 Token,也会因此更快消耗额度。 整理下来,有 11 个最实用的技巧: 1. 换任务就 /clear。一个任务做完就清掉上下文。还在做同一个任务,只是前面的内容没用了,再用 /compact 压缩。长会话越往后越贵,因为每一轮都会重新带上之前的内容。 2. 模型和 effort 开局就选好。中途执行 /model 或 /effort 会打掉 prompt cache(提示词缓存),下一轮需要重新处理整段上下文。Fast mode 也是一样,最好一开始就开。 3. 离开前先 /compact。订阅用户的缓存约 1 小时过期,API Key 默认约 5 分钟。缓存过期后再回来,下一轮通常要重新处理整个上下文。趁缓存还在时压缩更便宜。 4. 最近几轮跑偏就 /rewind。它只删掉后面几轮,前面的缓存还能继续用。/compact 会重写整个对话,成本更高。 5. 文件直接用 @ 文件名。Claude 会在第一轮直接拿到文件,可以省掉一次 Read 或搜索。一个文件通常只需要 @ 一次,重复 @ 反而可能把同一文件再塞一份进上下文。 6. Prompt 尽量说具体。与其说「测试挂了」,不如直接告诉 Claude 哪个测试、哪个文件。否则它可能先 grep、搜索、读一堆文件,这些结果之后每一轮都会继续占上下文。 7. 测试和日志尽量少输出。Build、测试、git log 的输出都会留在上下文。可以加 quiet 参数、只输出错误,或者用 tail 截断。Claude Code 对超过 3 万字符的命令输出反而会自动写入文件,只把摘要和路径留在会话里。 8. 用 /context 查启动负担。新会话一开始就可以看 CLAUDE.md、MCP 和工具定义占了多少上下文。CLAUDE.md 只放通用规则,专项流程放进按需加载的 Skill,不用的 MCP 用 /mcp 关掉。 9. 简单任务用更小的模型、更低的 effort。大模型输入和输出都更贵,thinking 也属于输出 Token。纯执行类任务没必要一直用最高档模型和最高推理强度。 10. 大日志交给 subagent,小任务别滥用。Subagent 有独立上下文,只把最终结果带回主会话,适合读大量日志、搜索文档。但它也要重新读文件、自己跑多轮,小任务反而可能更贵。搜索、读日志这类任务还可以指定 Haiku 或 Sonnet。 11. /loop 最好单独开会话。每次循环都是完整的一轮,会重复携带当前会话的全部上下文。如果间隔超过缓存时间,还可能叠加一次缓存失效。官方建议另开终端,用一个干净会话专门跑循环。 Anthropic 的建议归根结底就是:少塞无用内容,任务结束及时清,会话别拖得太长。

08-14 08:58

OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API

据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。