返回 7*24 快讯
来源MarsBit

OpenAI前CTO新公司开源首个模型Inkling,架构借鉴DeepSeek-V3

据动察 Beating 监测,OpenAI 前 CTO Mira Murati 创办的 Thinking Machines Lab,发布首个通用模型 Inkling。模型总参数 9750 亿,每次激活 410 亿,支持文本、图像和音频,最长上下文为 100 万 token。 Inkling 从零训练,但 MoE 架构主要参考 DeepSeek-V3。后训练初期还使用了 Kimi K2.5 等开放模型生成的数据。完整权重已上架 Hugging Face,采用 Apache 2.0 许可。 Thinking Machines 明确承认,Inkling 目前不是最强模型。它主打定制和效率。在 Terminal Bench 2.1 达到相同成绩时,所用 token 约为英伟达 Nemotron 3 Ultra 的三分之一。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

07-26 22:03

Mira Murati新开源大模型 Inkling 上线 OpenRouter,主打企业级代理工具调用

PANews 7月26日消息,据Decrypt报道, 前 OpenAI 首席技术官 Mira Murati 旗下 Thinking Machines Lab 于 7 月 15 日发布首个开源大模型 Inkling ,采用 9750 亿参数 MoE 架构、推理时激活约 410 亿参数,支持文本、图片、音频输入及 100 万上下文窗口,并在 MCP Atlas 代理工具调用评测中取得 74.1% 任务完成率、在 SWE-Bench Verified 中完成率达 77.6%。

07-30 08:47

Lilian Weng健康原因离职Thinking Machines Lab后,重返OpenAI

火星财经消息,7 月 30 日,Thinking Machines Lab 联合创始人 Lilian Weng 因健康原因(过去七个月反复生病,创业压力过大)宣布辞职,仅几天后即重返 OpenAI。 她将领导一个专注于「递归自我改进(recursive self-improvement)」研究的团队。该方向是她近期在博客中深入探讨的主题,旨在利用 AI 开发更强大的系统。 翁丽莲曾任 OpenAI 安全研究副总裁及应用 AI 研究团队负责人,2025 年初与前 OpenAI CTO Mira Murati 等人共同创立 Thinking Machines Lab。此次快速回归凸显了顶尖 AI 人才在高强度前沿实验室间的流动。

07-27 21:08

英伟达投资OpenAI联创新AI实验室,提供大规模GPU算力支持

BlockBeats 消息,7 月 27 日,据 WSJ 报道,英伟达已投资 OpenAI 前首席科学家 Ilya Sutskever 创办的 AI 实验室 Safe Superintelligence(SSI),双方达成长期合作协议,旨在扩大 SSI 计算资源,同时帮助英伟达锁定 AI 领域重要客户。 两家公司表示,英伟达在了解 SSI 部分研究进展后进行了「大规模」投资,但未披露具体金额。作为合作的一部分,SSI 将获得大量英伟达旗舰 GPU 资源,其计算能力预计将提升一个数量级。 此前,SSI 主要依赖谷歌提供的 TPU 芯片进行 AI 研发。此次合作意味着英伟达正在进一步扩大其 AI 芯片生态,并通过投资顶级 AI 实验室绑定未来算力需求。 SSI 成立于 2024 年,由 Ilya Sutskever 创办,目标是研发「安全超级智能」(Safe Superintelligence)。该公司此前已获得约 20 亿美元融资,投资方包括 Andreessen Horowitz 和 Sequoia Capital,去年估值达到约 300 亿美元。 这并非英伟达首次投资前 OpenAI 核心成员创办的 AI 公司。今年 3 月,英伟达也投资了 OpenAI 前首席技术官 Mira Murati 创办的 Thinking Machines Lab,该公司首个 AI 模型基于英伟达硬件训练。 Ilya Sutskever 是现代人工智能领域的重要研究者之一,曾参与创办 OpenAI,并推动 ChatGPT 等大模型技术发展。不过,离开 OpenAI 后,他开始质疑单纯依靠扩大数据和算力规模推动 AI 进步的路线,转而探索新的超级智能研究方向。

07-17 18:48

中美拟上市AI大模型公司一览:OpenAI、Anthropic最快2026年Q4上市,DeepSeek筹备A股挂牌

BlockBeats 消息,7 月 17 日,中美 AI 大模型公司正加快推进资本市场计划,Anthropic、OpenAI、DeepSeek、月之暗面、阶跃星辰等公司已处于递交文件、上市筹备或早期评估阶段,拟上市地点覆盖美股、A 股及港股。BlockBeats 整理排队敲钟的公司如下: 第一类:已递交文件,更接近上市 这类公司已秘密递交 S-1 文件,上市进展最为领先。 Anthropic 于 6 月 1 日秘密递交 S-1,拟登陆美股,最快可能于 2026 年第四季度上市。公司最新投后估值约 9650 亿元,最新一轮融资 650 亿元,累计融资约 1320 亿元。 OpenAI 于 6 月 8 日秘密递交 S-1,同样拟在美股上市,最快上市时间为 2026 年第四季度。公司最新投后估值约 8520 亿元,最新一轮融资 1220 亿元,累计融资约 1800 亿元。 第二类:已启动筹备或处于评估阶段 这类公司尚未进入公开招股阶段,但已启动上市筹备、接洽投行或据传递交文件。 DeepSeek 已启动 A 股上市筹备,最新投前估值约 710 亿元,最新一轮融资 70 亿元,累计融资约 70 亿元,计划于 2026 年末递交材料,并在 2027 年挂牌。 月之暗面正对港股上市进行早期评估,并已接洽投行。公司最新投后估值约 200 亿元,最新一轮融资 20 亿元,累计融资超过 50 亿元,目前尚无明确上市时间表。 阶跃星辰据传已秘密递交港股上市文件,最新估值约 120 亿元,最新一轮融资接近 25 亿元,累计融资超过 30 亿元,具体上市时间待定。 第三类:仅表达意向,尚未正式启动 这类公司已释放上市计划,但尚未进入实质性申报阶段。 百川智能已表达上市意向,但相关程序尚未启动,拟上市地点待定。公司最新估值约 200 亿元人民币,最新一轮融资 50 亿元人民币,累计融资约 75 亿元人民币,预计于 2027 年启动上市工作。 Perplexity 同样尚未正式启动上市流程,拟登陆美股,最新估值约 210 亿元,最新一轮融资 2 亿元,累计融资约 17 亿元,计划于 2028 年上市。

08-05 10:12

DeepSeek把谷歌挤下榜首,拿下OpenRouter本周调用量第一

据动察 Beating 监测,模型聚合平台 OpenRouter 数据显示,DeepSeek 文本请求量本周已达到 2.99 亿次,占平台总量的 27.1%,超过此前长期领先的谷歌。谷歌同期为 2.77 亿次、25.0%,OpenAI 以 1.85 亿次、16.8% 排名第三。 这个榜单按模型厂商合并统计文本 API 请求次数。DeepSeek V4 Flash、V4 Pro 等模型产生的调用,都会记入 DeepSeek 名下。 DeepSeek 的增长主要由 V4 系列推动。OpenRouter 此前披露,V4 发布后,DeepSeek 的 Token 份额半年内大致翻倍,增长主要来自 Agent 任务。V4 Flash 上线一个月后,已占 DeepSeek Agent Token 用量的 70%。Agent 完成一次任务往往会连续调用模型多次,也更容易推高请求量。

08-14 10:18

OpenAI冲IPO再换营收一把手,总裁Brockman开始接管更多经营权

据动察 Beating 监测,OpenAI 首席营收官 Denise Dresser 宣布离职,上任还不到一年。接替她的是 Wiz 前总裁兼 COO Dali Rajic,后者将负责 OpenAI 接下来的企业销售和营收增长。 这已经是 OpenAI 本周第二名重要高管离开。前 COO、特殊项目负责人 Brad Lightcap 两天前刚宣布离职,负责 AGI 业务的 Fidji Simo 上个月也已卸任。联合创始人兼总裁 Greg Brockman 正在接手更多经营职责,并组建自己的管理团队。