返回 7*24 快讯
来源MarsBit

摩尔线程张建中:智算集群向十万卡规模演进已成必然趋势

火星财经消息,摩尔线程创始人张建中8月21日在2026世界机器人大会上表示,具身智能产业正迎来类似大模型的“ChatGPT 时刻”,算力底座是发展关键。语言模型已跨越万亿参数门槛,在缩放定律(Scaling Law)驱动下,具身智能模型也正从十亿、百亿级向千亿、万亿级参数进化,智算集群随之从千卡迈向万卡,向十万卡规模演进已成必然趋势。(财联社)
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-19 19:35

智谱创始人唐杰:大模型Scaling不只是堆参数,未来竞争核心转向后训练与推理能力

Odaily星球日报讯 智谱创始人唐杰在 X 平台发布关于大模型 Scaling Law 的思考文章表示,当前人工智能行业对模型能力提升的理解正在从“扩大参数规模”转向多维度扩展,参数量并非衡量模型能力的唯一指标,还需要结合数据规模、计算资源分配方式以及模型实际运行场景综合评估。 唐杰指出,早期研究曾推动行业快速扩大模型参数规模。Kaplan 等人在 2020 年的研究认为,模型参数增长速度应高于数据增长速度,推动了 GPT-3、Gopher、MT-NLG 等超大规模模型的发展。但 Hoffmann 等人在 2022 年通过分析数百个模型发现,计算最优方案更接近“每个参数对应约 20 个训练 Token”,模型参数和数据规模应保持同步增长,过去追求万亿参数模型的路线实际上是一次行业共同经历的“偏航”。随着模型应用场景变化,推理成本逐渐成为生命周期成本的重要组成部分,优化目标也从单纯降低训练成本转向提升长期运行效率,因此“小模型+更充分训练”的路线开始受到关注。 唐杰表示,稀疏混合专家(MoE)架构进一步改变了 Scaling 逻辑。在 MoE 模型中,总参数量决定模型能够存储多少知识,而激活参数和有效深度更影响模型完成复杂推理任务的能力。对于漏洞发现等需要长链条推理的任务而言,能力并不来自简单记忆更多信息,而是需要模型保持多步推理过程的连贯性。近期研究显示,最优“Token/参数比例”并不存在统一答案:偏向记忆型任务需要更多参数,而偏向推理型任务则更依赖更多数据和计算深度。在固定训练数据规模下,盲目增加总参数甚至可能削弱推理能力,而增加激活专家数量则更有助于提升模型表现。 围绕智谱最新模型进展,唐杰透露,GLM-5.3 是一次针对 Scaling 方向的实验。该模型与 GLM-5.2 采用相同基础模型、架构以及总参数和激活参数规模,但通过一个月的大规模长周期环境训练和强化学习(RL)进行后训练优化,性能提升并非来自参数增加,而是来自后训练阶段的扩展。他总结称,大模型竞争已经从单纯比拼参数规模,进入探索“多维 Scaling”的阶段,未来模型能力提升将更多依赖训练策略、推理深度以及后训练能力的持续优化。

40分钟前

全球首个开源太空具身智能合作项目SpaceClaw(太空龙虾)达成战略合作

火星财经消息,近日,群体智能基础模型公司超脑未来、商业航天企业未来宇航与特种机器人企业希云柔控正式达成战略合作,共同启动SpaceClaw(太空龙虾)计划。三方将分别发挥群体智能基础模型、空间飞行器与柔性机械臂优势,共同建设全球首个以开源方式推进、以真实在轨验证为目标的太空具身智能合作项目。SpaceClaw计划在合作启动后的6个月内完成首阶段在轨验证,并同步发布面向全球开发者和科研机构的太空具身智能基准OrbitBench。

08-20 10:13

王兴兴:具身智能跨越ChatGPT时刻,关键在于模型与机器人对齐

8月20日,在2026世界机器人大会主论坛上,宇树科技董事长、总经理兼首席技术官王兴兴表示,具身智能迈过ChatGPT时刻最核心的挑战是,AI模型的输入输出和真实机器人的对齐。(界面)

08-18 23:14

World Liberty称WorldClaw为独立公司,拒绝披露双方财务关系

PANews 8月18日消息,据CoinDesk报道,World Liberty表示其不拥有或运营AI平台WorldClaw,也不控制平台提供的模型,但拒绝说明是否持股、融资或参与收入分成。WorldClaw接入超300个中美AI模型,并以USD1作为支付方式之一,但其服务条款禁止美国和中国的用户使用。

08-16 15:41

ChatGPT超长聊天加载提速94%:741轮对话从28秒降到2秒

据动察 Beating 监测,OpenAI 正准备优化 ChatGPT 和 Codex 的超长对话体验,下周上线。内部测试一段 741 轮、231MB 的巨型聊天后,平均打开时间从 27.62 秒降到 1.66 秒,加载速度提升约 94%。 这次优化主要针对聊天记录加载,不是模型回答速度提升。测试中,需要加载的对话条目从 15,529 个降到 64 个,请求次数从 894 次降到 16 次,整个 App 的内存增长也减少 41.2%。 对于长期使用 ChatGPT 或 Codex 的用户,这能明显减少打开旧对话时的等待时间。过去一个超长线程越聊越卡,主要原因就是客户端需要处理大量历史消息;这次 OpenAI 直接减少了需要加载的数据量。

08-14 10:08

ChatGPT不再靠截屏记住你:电脑记忆改成记录操作轨迹

据动察 Beating 监测,OpenAI 上线 Computer History,正式替代此前的 Chronicle。旧版靠截屏了解你最近在电脑上做什么,新版彻底取消截屏,改为记录点击、输入、快捷键和 App 切换等操作。 这些记录会被整理成时间线和本地记忆。以后你问「我刚才改了哪个文件」「昨天在忙什么」,ChatGPT 和 Codex 都可以先从历史里定位。OpenAI 称,相比 Chronicle,新方案消耗的 token 更少。 它还能发现你反复做的操作,并建议直接做成 Skill 或 Automation。以前只是记住「你干过什么」,现在开始记「你平时怎么干活」。 目前 Computer History 仅在 macOS 上向 Pro、Business 和 Enterprise 用户开放,默认关闭,也可以单独排除某些 App 和网站。