返回 7*24 快讯
来源MarsBit

AI 数据中心运营商 DataVita 完成超 4 亿美元融资,ING 等参投

火星财经消息,据彭博社报道,AI 数据中心运营商 DataVita 宣布完成 4.06 亿美元融资,ING、ABN AMRO、西班牙桑坦德银行、苏格兰国家投资银行以及西门子金融服务参投。新资金将用于人工智能数据中心园区,并与 AI 云计算服务商 CoreWeave 达成 15 年数据中心租约。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-20 19:53

Hudson River 与 Coreweave 签署 AI 交易

火星财经消息,Hudson River 与 Coreweave (CRWV.O) 签署了一项数十亿美元规模的人工智能交易。

08-20 11:06

Ark Invest昨日减持Roblox及Brera Holdings股票

火星财经消息,8 月 20 日,据 Ark Invest Tracker 报道,Cathie Wood 旗下 Ark Invest 于昨日减持 501466 股 Roblox 股票(约 1940 万美元)及 28549 股 Brera Holdings 股票(约 12 万美元)。

08-20 08:18

Hudson River Trading Q2交易收入创纪录达114亿美元

Odaily星球日报讯 量化交易公司 Hudson River Trading(HRT)第二季度交易收入创纪录达到 114 亿美元,同比增长超过 3 倍;同期净利润达 74 亿美元,调整后 EBITDA 约 80 亿美元,较去年同期的 17.5 亿美元增长逾 350%。 此外,HRT 在 7 月 AI 股票暴跌期间仍实现盈利,且未直接持有 Situational Awareness 的风险敞口。同期,Jane Street 受 Situational Awareness 投资等因素影响,7 月录得 150 亿美元亏损,为十年来首次出现单月亏损。(彭博社)

08-19 23:52重要

价值367万美元,Longling Capital卖出1800枚ETH并转入币安

Odaily星球日报讯 据链上分析师余烬监测,在今晚 ETH 上涨至 2100 美元后,Longling Capital(隆领资本)(0x83E...E4Bd8)卖出 1800 枚 ETH,并将其转入币安,价值 367 万美元。

08-19 21:10

Abnormal AI 与 OpenAI 建立战略合作

火星财经消息,Abnormal AI 宣布与 OpenAI 建立战略合作伙伴关系,以加速企业人工智能应用。

08-19 19:35

智谱创始人唐杰:大模型Scaling不只是堆参数,未来竞争核心转向后训练与推理能力

Odaily星球日报讯 智谱创始人唐杰在 X 平台发布关于大模型 Scaling Law 的思考文章表示,当前人工智能行业对模型能力提升的理解正在从“扩大参数规模”转向多维度扩展,参数量并非衡量模型能力的唯一指标,还需要结合数据规模、计算资源分配方式以及模型实际运行场景综合评估。 唐杰指出,早期研究曾推动行业快速扩大模型参数规模。Kaplan 等人在 2020 年的研究认为,模型参数增长速度应高于数据增长速度,推动了 GPT-3、Gopher、MT-NLG 等超大规模模型的发展。但 Hoffmann 等人在 2022 年通过分析数百个模型发现,计算最优方案更接近“每个参数对应约 20 个训练 Token”,模型参数和数据规模应保持同步增长,过去追求万亿参数模型的路线实际上是一次行业共同经历的“偏航”。随着模型应用场景变化,推理成本逐渐成为生命周期成本的重要组成部分,优化目标也从单纯降低训练成本转向提升长期运行效率,因此“小模型+更充分训练”的路线开始受到关注。 唐杰表示,稀疏混合专家(MoE)架构进一步改变了 Scaling 逻辑。在 MoE 模型中,总参数量决定模型能够存储多少知识,而激活参数和有效深度更影响模型完成复杂推理任务的能力。对于漏洞发现等需要长链条推理的任务而言,能力并不来自简单记忆更多信息,而是需要模型保持多步推理过程的连贯性。近期研究显示,最优“Token/参数比例”并不存在统一答案:偏向记忆型任务需要更多参数,而偏向推理型任务则更依赖更多数据和计算深度。在固定训练数据规模下,盲目增加总参数甚至可能削弱推理能力,而增加激活专家数量则更有助于提升模型表现。 围绕智谱最新模型进展,唐杰透露,GLM-5.3 是一次针对 Scaling 方向的实验。该模型与 GLM-5.2 采用相同基础模型、架构以及总参数和激活参数规模,但通过一个月的大规模长周期环境训练和强化学习(RL)进行后训练优化,性能提升并非来自参数增加,而是来自后训练阶段的扩展。他总结称,大模型竞争已经从单纯比拼参数规模,进入探索“多维 Scaling”的阶段,未来模型能力提升将更多依赖训练策略、推理深度以及后训练能力的持续优化。