黄仁勋:英伟达的GroQ芯片在一段时间内仍将是小众产品
相关推荐
Groq完成6.5亿美元融资,加速扩建AI推理云并目标2027年底达200兆瓦
火星财经消息 6月24日消息,AI芯片初创公司Groq当地时间6月22日宣布完成6.5亿美元新一轮增长融资,由Disruptive和Infinitum领投,部分现有投资者跟投。所得资金将用于加速现有数据中心基础设施升级,包括部署英伟达最新LPX系统,并目标于2027年底将总装机容量扩展至200兆瓦。 管理团队方面,Groq同步引入多位新高管:前xAI(现SpaceXAI)及Meta数据中心负责人艾伦·莱斯(Alan Rice)出任首席运营官;辛克莱·舒勒(Sinclair Schuller)及拉克什·马尔霍特拉(Rakesh Malhotra)将分别于7月起出任首席技术官和首席产品官。(广角观察)
AI芯片初创公司Groq融资3.5亿美元,估值降至35亿美元
PANews 8月17日消息,据彭博社报道,AI芯片初创公司Groq完成3.5亿美元融资,但公司估值降至35亿美元,约为近一年之前估值的一半。本轮融资由总部位于达拉斯的投资机构Disruptive领投,英伟达(Nvidia)也将参与投资。Groq成立于2016年,曾被视为英伟达AI芯片领域的重要竞争者之一,专注于开发用于人工智能计算的专用硬件,该公司目前正转型为AI数据中心运营商,重点服务AI模型推理需求。
Groq 融资后估值达 35 亿美元
ChainCatcher 消息,市场消息称,在与英伟达达成交易后,Groq 在一轮融资中的估值达到 35 亿美元。
ZCode免费送1亿GLM-5.3 Token,太火导致上线一小时就暂停
据动察 Beating 监测,智谱旗下编程 Agent 工具 ZCode,给 GLM-5.3 推出了一场周末免费活动。新用户首次登录 ZCode,即可获得 1 亿 GLM-5.3 Token,用于 AI 编程、代码修改和 Agent 任务。 活动原定北京时间 8 月 16 日 0 点开始,持续到 17 日上午 9 点。结果上线一小时,ZCode 就宣布暂停新增 1 亿 Token 发放。官方称活动需求「超出预期」,正在调整服务容量。 已经领取的额度不受影响,普通新用户的 300 万 GLM-5.3 Token 福利仍然开放。ZCode 表示,等容量恢复后会重新开启 1 亿 Token 活动。
Claude Code官方省Token指南:11个技巧让额度用得更久
据动察 Beating 监测,Anthropic 发布 Claude Code 省 Token 指南。核心就一句:上下文越长,后面每一轮越贵。聊天、文件和命令输出都会继续占用 Token,也会因此更快消耗额度。 整理下来,有 11 个最实用的技巧: 1. 换任务就 /clear。一个任务做完就清掉上下文。还在做同一个任务,只是前面的内容没用了,再用 /compact 压缩。长会话越往后越贵,因为每一轮都会重新带上之前的内容。 2. 模型和 effort 开局就选好。中途执行 /model 或 /effort 会打掉 prompt cache(提示词缓存),下一轮需要重新处理整段上下文。Fast mode 也是一样,最好一开始就开。 3. 离开前先 /compact。订阅用户的缓存约 1 小时过期,API Key 默认约 5 分钟。缓存过期后再回来,下一轮通常要重新处理整个上下文。趁缓存还在时压缩更便宜。 4. 最近几轮跑偏就 /rewind。它只删掉后面几轮,前面的缓存还能继续用。/compact 会重写整个对话,成本更高。 5. 文件直接用 @ 文件名。Claude 会在第一轮直接拿到文件,可以省掉一次 Read 或搜索。一个文件通常只需要 @ 一次,重复 @ 反而可能把同一文件再塞一份进上下文。 6. Prompt 尽量说具体。与其说「测试挂了」,不如直接告诉 Claude 哪个测试、哪个文件。否则它可能先 grep、搜索、读一堆文件,这些结果之后每一轮都会继续占上下文。 7. 测试和日志尽量少输出。Build、测试、git log 的输出都会留在上下文。可以加 quiet 参数、只输出错误,或者用 tail 截断。Claude Code 对超过 3 万字符的命令输出反而会自动写入文件,只把摘要和路径留在会话里。 8. 用 /context 查启动负担。新会话一开始就可以看 CLAUDE.md、MCP 和工具定义占了多少上下文。CLAUDE.md 只放通用规则,专项流程放进按需加载的 Skill,不用的 MCP 用 /mcp 关掉。 9. 简单任务用更小的模型、更低的 effort。大模型输入和输出都更贵,thinking 也属于输出 Token。纯执行类任务没必要一直用最高档模型和最高推理强度。 10. 大日志交给 subagent,小任务别滥用。Subagent 有独立上下文,只把最终结果带回主会话,适合读大量日志、搜索文档。但它也要重新读文件、自己跑多轮,小任务反而可能更贵。搜索、读日志这类任务还可以指定 Haiku 或 Sonnet。 11. /loop 最好单独开会话。每次循环都是完整的一轮,会重复携带当前会话的全部上下文。如果间隔超过缓存时间,还可能叠加一次缓存失效。官方建议另开终端,用一个干净会话专门跑循环。 Anthropic 的建议归根结底就是:少塞无用内容,任务结束及时清,会话别拖得太长。
广东省首个词元经济专项金融产品“Token贷”在广州海珠发布
火星财经消息,广东省首个词元经济专项金融产品“Token贷”在广州海珠区发布。以中国银行广州分行为例,针对海珠算力中小微企业针对性研发专属融资产品——算力Token贷,按合同/Token消耗额度核定额度,可提供信用、应收账款质押、订单融资为主的担保方式,亦可组合保证、抵押等组合担保,进一步扩大额度。新公司亦可在原经营企业提供连续经营佐证材料、或提供担保的情况下按订单申请融资。据悉,中国银行前期试单授信资金已达2800万元。(财联社)