返回 7*24 快讯
来源MarsBit

外媒:Anthropic Mythos的威胁促使DeepSeek开启首次巨额融资

据 动察 Beating 监测,The Information 援引知情人士报道,DeepSeek 决定放弃由创始人全额出资的模式并启动首轮超 500 亿元(约 74 亿美元)的融资,直接导火索是 Anthropic 在 4 月展示的安全模型 Mythos。 Mythos 具备寻找并利用软件漏洞的能力。DeepSeek 研发团队评估认为,面对需要超大规模算力和数据堆叠、甚至具有国家安全级别破坏力的模型,仅靠梁文锋个人财富支撑将无法在算力军备竞赛中竞争,必须引入外部资金扩建算力池。 DeepSeek 去年为应对美方出口管制,尝试将训练与部署系统从 Nvidia 的 CUDA 生态迁移到华为芯片,重写底层软件导致新一代模型延期发布长达 15 个月。 DeepSeek 过去保持极度扁平运行,未设立人力资源与公关部门,所有人直接向梁文锋汇报。伴随巨额融资完成,团队正开始招募法务、财务及人力资源等职能岗位。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-07 13:25

字节10万亿参数模型已开训,规模逼近Anthropic Mythos5

据动察 Beating 监测,英国《金融时报》援引三名知情人士称,字节跳动已经开始预训练一款最高 10 万亿参数的大模型。项目仍处于早期阶段,最终规模尚未确定。如果按上限训练,它将达到 Kimi K3 的三倍以上,成为目前已知中国团队中参数规模最大的模型。 字节这次直接把模型尺寸推到了 Anthropic 旗舰附近。Anthropic 从未公布 Mythos 5 的参数量,但《金融时报》援引行业估算称,Mythos 5 约为 8 万亿参数,Fable 5 约为 5 万亿。字节新模型若做到 10 万亿,至少在参数规模上已经进入美国最前沿闭源模型的同一量级。 这款模型目前还在预训练(用海量数据训练模型的基础能力)。《金融时报》称,这一阶段通常需要 3 至 6 个月,之后还要继续后训练,顺利才会发布。参数更多也不等于能力一定更强,最终表现还取决于架构、训练数据和训练方法。 张一鸣近期在 Seed 内部明确反对蒸馏竞争对手模型,要求团队接受短期落后,靠自研冲击世界第一梯队。这款最高 10 万亿参数的新模型,是字节目前最激进的一次规模下注。

07-26 19:23

Anthropic技术成员讽刺科技巨头拥抱开源:期待英微软开源Windows、英伟达开源CUDA

Odaily星球日报讯 Anthropic 技术成员 Julian Schrittwieser 近日在社交平台发文,调侃部分科技巨头近年来对“开源”态度的转变,并称期待英伟达和微软进一步开放核心技术,并表示:“很高兴看到 Jensen Huang 成为开源的支持者,期待 CUDA 和 GPU 驱动开源发布;同时也期待 Satya Nadella 支持开源,希望未来能看到 Windows 和 Microsoft Office 开源。” Julian Schrittwiese 还回应外界关于其反对开放权重模型(open weight models)的猜测,表示这种解读并不准确。他认为,开放模型实际上可以在很多场景中发挥重要作用。不过,Schrittwieser 指出,令人感兴趣的是,一些过去长期对开源持非常谨慎甚至反对态度的公司,如今正在迅速转向支持开放生态。 近年来,随着人工智能竞争加剧,开源模型、开放权重以及开发者生态成为科技行业的重要竞争领域。包括英伟达、微软等企业也不断强调对开放生态的支持,但业内对于“开放”的定义仍存在争议——部分企业开放模型接口、工具链或生态,而核心商业资产仍保持闭源。 Julian Schrittwiese 的言论也引发讨论,焦点集中在科技巨头推动“选择性开源”是否代表真正的开放,还是一种新的生态竞争策略。

07-21 21:37

DeepSeek V4正式版本月底前或将上线,完成去CUDA适配

PANews 7月21日消息,据PConline太平洋科技报道,DeepSeek-V4正式版已开启小规模灰度测试,包含DeepSeek-V4-Pro与DeepSeek-V4-Flash两个版本。知情人士称,正式版预计本月底发布,相比此前计划的7月中旬有所推迟,新版本将重点优化推理效率、响应速度和智能体能力。参与测试的开发者称,V4综合能力对标Anthropic Opus 4.8,代码生成接近OpenAI GPT-5.6 Sol,并在3D建模、SVG图像生成和小游戏开发等场景表现提升。

07-17 18:48

中美拟上市AI大模型公司一览:OpenAI、Anthropic最快2026年Q4上市,DeepSeek筹备A股挂牌

BlockBeats 消息,7 月 17 日,中美 AI 大模型公司正加快推进资本市场计划,Anthropic、OpenAI、DeepSeek、月之暗面、阶跃星辰等公司已处于递交文件、上市筹备或早期评估阶段,拟上市地点覆盖美股、A 股及港股。BlockBeats 整理排队敲钟的公司如下: 第一类:已递交文件,更接近上市 这类公司已秘密递交 S-1 文件,上市进展最为领先。 Anthropic 于 6 月 1 日秘密递交 S-1,拟登陆美股,最快可能于 2026 年第四季度上市。公司最新投后估值约 9650 亿元,最新一轮融资 650 亿元,累计融资约 1320 亿元。 OpenAI 于 6 月 8 日秘密递交 S-1,同样拟在美股上市,最快上市时间为 2026 年第四季度。公司最新投后估值约 8520 亿元,最新一轮融资 1220 亿元,累计融资约 1800 亿元。 第二类:已启动筹备或处于评估阶段 这类公司尚未进入公开招股阶段,但已启动上市筹备、接洽投行或据传递交文件。 DeepSeek 已启动 A 股上市筹备,最新投前估值约 710 亿元,最新一轮融资 70 亿元,累计融资约 70 亿元,计划于 2026 年末递交材料,并在 2027 年挂牌。 月之暗面正对港股上市进行早期评估,并已接洽投行。公司最新投后估值约 200 亿元,最新一轮融资 20 亿元,累计融资超过 50 亿元,目前尚无明确上市时间表。 阶跃星辰据传已秘密递交港股上市文件,最新估值约 120 亿元,最新一轮融资接近 25 亿元,累计融资超过 30 亿元,具体上市时间待定。 第三类:仅表达意向,尚未正式启动 这类公司已释放上市计划,但尚未进入实质性申报阶段。 百川智能已表达上市意向,但相关程序尚未启动,拟上市地点待定。公司最新估值约 200 亿元人民币,最新一轮融资 50 亿元人民币,累计融资约 75 亿元人民币,预计于 2027 年启动上市工作。 Perplexity 同样尚未正式启动上市流程,拟登陆美股,最新估值约 210 亿元,最新一轮融资 2 亿元,累计融资约 17 亿元,计划于 2028 年上市。

07-15 13:21

DeepSeek年化收入逼近5亿美元,V4 API毛利率超50%

据动察 Beating 监测,《The Information》援引知情人士称,DeepSeek 最近年化收入达到 4 亿至 5 亿美元。收入主要来自企业和开发者通过 API 调用模型。 年化收入是按近期收入速度折算一年,并非已经实现的全年收入。 知情人士还称,DeepSeek 的 V4 API 毛利率超过 50%。公司虽然收费远低于 OpenAI 和 Anthropic,但通过优化基础设施,减少了运行模型所需的芯片。 DeepSeek 同时计划再募 500 亿元,估值约 5000 亿元,约合 740 亿美元。按年化收入上限计算,估值约为收入的 148 倍。 这与昨日披露的 4800 亿元、约 710 亿美元估值是同一轮融资,只是不同报道的数字口径略有差异。DeepSeek 还准备引入中东等海外投资者,并允许其使用美元投资。 相关收入、毛利率和融资数据均来自知情人士。DeepSeek 尚未回应。

07-14 12:30

DeepSeek最新一轮融资后,梁文锋身家超越Anthropic达里奥和OpenAI布罗克曼

BlockBeats 消息,7 月 14 日,据外媒报道,DeepSeek 完成最新一轮融资后,创始人梁文锋的个人财富增长逾一倍,使其成为全球 AI 大模型创始人中身家最高的人。根据彭博亿万富豪指数,梁文锋目前身家达 360 亿美元(此前约 167 亿美元),超过了 Anthropic 联合创始人达里奥·阿莫代伊和 OpenAI 联合创始人格雷格·布罗克曼。此次比较仅涵盖主营业务及大部分收入直接来自 AI 大模型的企业,不包括阿里巴巴、腾讯等业务多元化大型科技集团,也不包括数据中心、半导体等 AI 产业链相关企业。 梁文锋绝大部分财富来自对 DeepSeek 的控股。今年 6 月,DeepSeek 据悉完成 500 亿元融资,公司估值超 3300 亿元,梁文锋个人出资 200 亿元。根据彭博亿万富豪指数测算,其持股比例被稀释至约 78%。(金十)