Shaders开源200+WebGPU组件,AI写网页特效不用再从零写WGSL
相关推荐
DeepSeek开始直接对接大规模部署:有2000张GPU可以找官方
动察 Beating AI 快讯,DeepSeek 在 V4.1 Flash 开源公告里罕见地直接向大规模部署方喊话:如果有 2000 张 GPU 和存储集群,可以直接联系 DeepSeek。 但这并不是新的商业授权门槛。V4.1 Flash 仍按 MIT License 开源,没有按照公司营收或业务规模设置额外授权条件。有资源的企业可以自己部署,联系 DeepSeek 更像是针对超大规模场景的直接技术合作。DeepSeek 目前也没有宣布正式的私有化部署产品或收费服务。 过去 DeepSeek 开源模型后,部署适配更多由 SGLang、TensorRT-LLM 等推理框架和硬件厂商完成。这次官方主动留下大规模部署的直接联系方式,并表示会继续支持开源社区做新模型的推理适配,尝试进一步扩大部署范围。
SpaceXAI下周GPU总量将达100万块,马斯克称半年后领跑AI
动察 Beating AI 快讯,马斯克给 SpaceXAI 列出了追赶 OpenAI 和 Anthropic 的时间表。他称,未来 2 到 3 个月,有望做出达到 Anthropic Fable 和 OpenAI GPT-6 水平的模型。如果进步速度继续加快,约 6 个月后可以「占据领跑位置」。 他随后公布了 Colossus 的最新 GPU 数量。Colossus 1 有 15 万块 H100、5 万块 H200 和 3 万块 GB200;Colossus 2 有 11 万块 GB200 和 44 万块 GB300。两座数据中心合计约 78 万块,比此前外界估算的 67 万块更多。 另有 22 万块 GB300 将在下周全部投入运行,届时总量正好达到约 100 万块。11 月还将增加 22 万块。如果进展顺利,12 月底可能再增加 22 万块,总量达到约 144 万块。
不想被OpenAI和Anthropic卡脖子,美国第二大律所自己买GPU自建AI系统
动察 Beating AI 快讯,美国第二大律所 Latham & Watkins 开始自己买英伟达 GPU,在内部运行 AI 模型。 律所已经采购 H200 GPU,并把服务器放进只有自家员工能进入的数据中心。工程师正在微调英伟达 Nemotron 3 开放权重模型。 这样一来,最敏感的客户材料不用交给外部云厂商。ChatGPT、Claude、Gemini 等商业模型仍然继续使用,律师可以根据任务选择不同模型。 这是首个公开披露的大型律所自购 AI 硬件并微调模型的案例。Latham 已经为这套系统准备了三年,也给自己留了一条不依赖 OpenAI、Anthropic 等单一供应商的路。
H100租金一个月涨22%,黄仁勋:GPU是会赚钱的资产
动察 Beating AI 快讯,英伟达 CEO 黄仁勋转发算力市场 Ornn 的数据。Ornn 称,H100 已经是一款推出多年的训练 GPU,但过去一个月租金反而上涨 22%,最新达到每块每小时 3.28 美元。黄仁勋借此强调,英伟达算力可以持续出租赚钱,是一种能产生收入的资产。 Ornn 的 H100 指数根据实际租赁成交价格计算。其 9 月 7 日的日结算价为每小时 3.17 美元,Ornn 随后展示的最新价格进一步升至 3.28 美元。 这组数据正好支撑了黄仁勋最近反复强调的「算力耐用」逻辑。英伟达在最新财报会上也称,GPU 可以在不同客户和工作负载之间重新部署。
蚂蚁百灵金融模型正式开源:MIT许可,123道金融搜索题也放出
动察 Beating AI 快讯,蚂蚁百灵正式开源金融模型 Ling-3.0-flash-Fin。模型拥有 1240 亿总参数、51 亿激活参数,支持 256K 上下文。官方放出的 BF16 权重约 255GB,采用 MIT 许可证,可以用 vLLM 和 SGLang 自行部署。 一起开源的还有金融搜索基准 FinFIRST。它由蚂蚁集团开发,中金公司投行团队提供专业支持,50 多名金融专业人士参与出题和验证。最终只有 9.78% 的候选题通过筛选,留下 123 道题。其中 61.8% 需要计算,32.5% 需要同时查多个来源。 每道题会拆成多个评分点,分别检查 AI 有没有找对数据、用对信源、核准时间和统计口径,以及计算结果是否正确。整套数据共有 701 个细分评分点。现在题目、参考答案和评分标准全部公开,采用 Apache 2.0 许可证。
Ilya警告:下一次AI失控,可能抢下GPU云不断复制自己
动察 Beating AI 快讯,OpenAI 前首席科学家 Ilya Sutskever 警告,专门出租 AI GPU 算力的 neocloud 安全防护还不够到位。他认为,下一次 Agent 真正失控时,可能直接攻下这类平台,用抢来的算力运行更多自己的副本。 Ilya 呼吁 neocloud 大幅加固网络安全。拥有强大网络安全模型的 AI 公司,也应该出手帮忙。 这个风险需要两个条件:Agent 能突破原有控制,云平台本身又有漏洞。两个条件最近都出现了。OpenAI 上周承认,内部网络安全评测中的 Agent 曾绕过隔离,并入侵部分 Hugging Face 系统。 SemiAnalysis 随后公布对 neocloud 的安全测试。研究人员发现,部分平台能读取其他租户的数据,甚至从自己的容器或虚拟机逃出去攻击其他租户。最严重的一次,漏洞可以一路扩大到跨租户远程执行代码。相关问题已经通知厂商,并已修补或确认升级。