返回 7*24 快讯
来源MarsBit

Cohere开源Command A+:218B参数MoE大模型,主打企业级Agent与数据主权

据动察 Beating 监测,Cohere 正式开源 2180 亿参数的稀疏混合专家模型 Command A+,采用 Apache 2.0 协议支持企业级 Agent 构建与私有化部署。新模型专为关键基础设施的数据主权需求设计,支持企业在无厂商锁定的情况下进行物理隔离部署。 新模型总参数量为 2180 亿(218B),但单次推理仅激活 250 亿(25B)参数,实现了计算效率与生成性能的平衡。优化后的推理效率使其仅需两张 NVIDIA H100 或单张 B200 GPU 即可运行,Hugging Face 也同步上线了 W4A4 等低精度量化版本,进一步降低了部署门槛。 Command A+ 原生支持多模态图文输入,提供 12.8 万(128K)Token 的输入上下文窗口以及 6.4 万 Token 的输出长度。它针对复杂的逻辑推理、自主工具调用、数据库查询等 Agentic 工作流以及长文档处理进行了深度优化,并支持包含所有欧盟官方语言在内的 48 种语言。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-05 12:40

Cursor重排GPU流水线,MoE模型训练提速41%

据动察 Beating 监测,Cursor 开源 Mixture-of-Kittens(MoK),用于加速 MoE 大模型训练。它把原本分开的 GPU 数据传输和计算,合进一个 kernel(直接在 GPU 上运行的底层程序)。 MoE 会把模型拆成大量「专家」,每次只调用其中一部分。专家分散在不同 GPU 上,数据需要频繁搬运,有时会占掉一半以上的训练时间。 MoK 让 GPU 一边传数据,一边做计算,减少等待。在 512 块 GB300 GPU 的实际训练中,整体吞吐提高 41%。单独测试 MoE 层时,最高比公开方案快 2.37 倍。 MoK 已用于 Cursor 数万块 GPU 的 Composer 训练,并以 Apache 2.0 开源。目前只支持英伟达 Blackwell GPU,主要面向拥有 GB200、GB300 NVL72 集群的机构。

07-15 13:03

预测市场Kalshi推出GPU价格预测市场,覆盖Nvidia B200、H200和A100芯片

火星财经消息,7 月 15 日,预测市场 Kalshi 宣布推出 GPU 计算前向曲线,覆盖 Nvidia B200、H200 和 A100 芯片,提供市场预期的未来计算价格预测。

06-18 20:51

HIVE BUZZ HPC 与 Bell、Cohere 签署 2.2 亿美元加拿大主权 AI GPU 合同

PANews 6月18日消息,加拿大比特币矿企 HIVE 旗下 BUZZ High Performance Computing(BUZZ HPC)与 Bell AI Fabric 和 Cohere Inc. 达成一项为期三年的主权 AI 基础设施合作,签署总额约 2.2 亿美元 GPU 云合同。

08-13 16:05

Cohere放出2.4B视觉小模型:文档理解超过Ministral 3 3B

据动察 Beating 监测,Cohere 开源了目前自家最小的视觉语言模型 North Micro Vision,只有 2.4B 参数,采用 Apache 2.0 许可。它主攻文档、表格、图表、截图和 OCR,可以直接处理原始比例和分辨率的图片,不必先压成固定尺寸。 模型由 2B 语言模型和 400M 视觉编码器组成。官方测试中,DocVQA 得分达到 92.1%,超过 Ministral 3 3B 的 89.6% 和 Gemma 4 E2B 的 73.2%,距离 Qwen3.5-2B 的 92.6% 也很近。视觉定位 RefCOCO 得分 73.2%,同样明显高于 Ministral 和 Gemma。 不过它并非同尺寸最强模型。Qwen3.5-2B 在多数通用视觉、OCR 和多模态基准上仍更强,North Micro Vision 的优势更集中在文档理解和视觉定位。它也不是推理模型,不支持工具调用,数学和代码能力有限。

07-24 09:26

微软自研模型加速替代OpenAI,GPU成本最高降89%

据动察 Beating 监测,微软 AI 开放 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash。前者主打高质量生图和图片编辑,后者面向客服和语音 Agent,速度是普通版的 2 倍,价格低 32%。 微软自研模型也已进入 Bing、PowerPoint、OneDrive 和 Dynamics 365。PowerPoint 的 GPU 成本较 GPT-Image-2 最多降低 84%,Dynamics 365 最多降低 89%。

07-19 20:57

天数智芯WAIC发布新一代通用GPU旗舰天垓300,对标Hopper

火星财经消息 7月19日消息,2026世界人工智能大会期间,天数智芯正式推出新一代自研架构首款产品,通用GPU旗舰天垓300。能效对标并超越Hopper架构主流方案,面向“信息智能—行动智能—探索智能”三重趋势重构算力底座。产品基于SIMT架构,围绕Attention、MoE、AF/PD分离及大规模扩展优化,兼顾计算效率、时延与TCO。Agent场景首字延迟降约20%,Decode通信延迟降13%;Cosmos3世界模型推理效能亦超Hopper 10%。目前天垓300具备规模化应用条件,正与中国云厂、服务器厂及超节点系统深度适配,支持单机到集群部署。(广角观察)