Cohere开源Command A+:218B参数MoE大模型,主打企业级Agent与数据主权
相关推荐
Cursor重排GPU流水线,MoE模型训练提速41%
据动察 Beating 监测,Cursor 开源 Mixture-of-Kittens(MoK),用于加速 MoE 大模型训练。它把原本分开的 GPU 数据传输和计算,合进一个 kernel(直接在 GPU 上运行的底层程序)。 MoE 会把模型拆成大量「专家」,每次只调用其中一部分。专家分散在不同 GPU 上,数据需要频繁搬运,有时会占掉一半以上的训练时间。 MoK 让 GPU 一边传数据,一边做计算,减少等待。在 512 块 GB300 GPU 的实际训练中,整体吞吐提高 41%。单独测试 MoE 层时,最高比公开方案快 2.37 倍。 MoK 已用于 Cursor 数万块 GPU 的 Composer 训练,并以 Apache 2.0 开源。目前只支持英伟达 Blackwell GPU,主要面向拥有 GB200、GB300 NVL72 集群的机构。
预测市场Kalshi推出GPU价格预测市场,覆盖Nvidia B200、H200和A100芯片
火星财经消息,7 月 15 日,预测市场 Kalshi 宣布推出 GPU 计算前向曲线,覆盖 Nvidia B200、H200 和 A100 芯片,提供市场预期的未来计算价格预测。
HIVE BUZZ HPC 与 Bell、Cohere 签署 2.2 亿美元加拿大主权 AI GPU 合同
PANews 6月18日消息,加拿大比特币矿企 HIVE 旗下 BUZZ High Performance Computing(BUZZ HPC)与 Bell AI Fabric 和 Cohere Inc. 达成一项为期三年的主权 AI 基础设施合作,签署总额约 2.2 亿美元 GPU 云合同。
Cohere放出2.4B视觉小模型:文档理解超过Ministral 3 3B
据动察 Beating 监测,Cohere 开源了目前自家最小的视觉语言模型 North Micro Vision,只有 2.4B 参数,采用 Apache 2.0 许可。它主攻文档、表格、图表、截图和 OCR,可以直接处理原始比例和分辨率的图片,不必先压成固定尺寸。 模型由 2B 语言模型和 400M 视觉编码器组成。官方测试中,DocVQA 得分达到 92.1%,超过 Ministral 3 3B 的 89.6% 和 Gemma 4 E2B 的 73.2%,距离 Qwen3.5-2B 的 92.6% 也很近。视觉定位 RefCOCO 得分 73.2%,同样明显高于 Ministral 和 Gemma。 不过它并非同尺寸最强模型。Qwen3.5-2B 在多数通用视觉、OCR 和多模态基准上仍更强,North Micro Vision 的优势更集中在文档理解和视觉定位。它也不是推理模型,不支持工具调用,数学和代码能力有限。
微软自研模型加速替代OpenAI,GPU成本最高降89%
据动察 Beating 监测,微软 AI 开放 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash。前者主打高质量生图和图片编辑,后者面向客服和语音 Agent,速度是普通版的 2 倍,价格低 32%。 微软自研模型也已进入 Bing、PowerPoint、OneDrive 和 Dynamics 365。PowerPoint 的 GPU 成本较 GPT-Image-2 最多降低 84%,Dynamics 365 最多降低 89%。
天数智芯WAIC发布新一代通用GPU旗舰天垓300,对标Hopper
火星财经消息 7月19日消息,2026世界人工智能大会期间,天数智芯正式推出新一代自研架构首款产品,通用GPU旗舰天垓300。能效对标并超越Hopper架构主流方案,面向“信息智能—行动智能—探索智能”三重趋势重构算力底座。产品基于SIMT架构,围绕Attention、MoE、AF/PD分离及大规模扩展优化,兼顾计算效率、时延与TCO。Agent场景首字延迟降约20%,Decode通信延迟降13%;Cosmos3世界模型推理效能亦超Hopper 10%。目前天垓300具备规模化应用条件,正与中国云厂、服务器厂及超节点系统深度适配,支持单机到集群部署。(广角观察)