返回 7*24 快讯
来源Blockbeats

传百度文心连补两员大将:北美Frontier Lab+DeepSeek OCR核心作者

动察 Beating AI 快讯,百度基础模型研发部(BMU)正在补强核心模型团队。知情人士称,负责人孙天祥从北美某 Frontier Lab 引入了一名花名「武钦」的研究员,和团队一起加强文心预训练。对方过去两年参与过数代前沿大模型研发,但真实姓名和原单位都没有披露。另一边,原 DeepSeek 研究员魏浩然及其团队也从百度内部转入 BMU,由他担任文心多模态算法负责人。 魏浩然这条线其实早有伏笔。6 月百度开源 Unlimited OCR 时,三名核心贡献者中的技术总监只署名「YY」,社区当时就猜测是魏浩然。魏浩然是 DeepSeek-OCR 和 DeepSeek-OCR 2 第一作者;DeepSeek-V4 技术报告也把他标记为已经离职。 Unlimited OCR 发布时在 OmniDocBench v1.6 拿到 93.92%,一度刷新端到端 OCR 纪录。它沿用了 DeepSeek-OCR 的 DeepEncoder,并重新设计解码端的注意力机制,可以一次连续解析几十页文档。 孙天祥 7 月刚接手 BMU,同时进入百度模型委员会,月底又进入百度技术战略委员会。两个月后,文心的预训练和多模态两条核心线都开始补人。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

49分钟前

ElevenLabs Music v2.5上线:免费版也给商用权,每天5首无损下载

动察 Beating AI 快讯,ElevenLabs 上线 Music v2.5,并把它设为 ElevenMusic 默认模型。新版本重点提升旋律、编曲层次和乐器真实感。官方让 v2 和 v2.5 用相同提示词各生成一版,做了 47,885 组盲测,v2.5 在多数对比中获胜。R&B、灵魂乐、嘻哈、摇滚、金属、管弦和电影配乐的差距最大。 而且现在授权也放宽了。Free 用户每天能下载 5 首无损歌曲,生成内容可以商用,但必须标注「Made with ElevenMusic」;Pro 每月有 400 次无损下载,不需要标注,还能把歌曲发行到流媒体平台。作品创建时拿到的权限以后不会因为降级或退订改变。基于其他艺人歌曲做改编的作品则不能下载或对外发行。 ElevenLabs 还明确表示 Music v2 不会下线。Suno 最近上线 v6,同时退役此前所有旧模型,引发不少老用户不满。HN 有用户实测后认为,v2.5 音质更好,但音乐性还是更喜欢 Suno v5。

09-11 05:14

DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一

动察 Beating AI 快讯,Artificial Analysis 完成 DeepSeek V4.1 Flash 独立测试,综合智能指数拿到 40 分。它已经超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这套第三方榜单,DeepSeek 还没夺回国产模型第一。 但价格差距非常夸张。V4.1 Flash 跑完一个 Intelligence Index 任务平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差约 7 倍。输出速度达到 197 Token/s,也远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。 Agent 依然是它最强的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 也拿到 84%。缺点是它特别能说,AA 测试中单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,吃掉了一部分价格优势。

09-10 07:17

DeepSeek开始直接对接大规模部署:有2000张GPU可以找官方

动察 Beating AI 快讯,DeepSeek 在 V4.1 Flash 开源公告里罕见地直接向大规模部署方喊话:如果有 2000 张 GPU 和存储集群,可以直接联系 DeepSeek。 但这并不是新的商业授权门槛。V4.1 Flash 仍按 MIT License 开源,没有按照公司营收或业务规模设置额外授权条件。有资源的企业可以自己部署,联系 DeepSeek 更像是针对超大规模场景的直接技术合作。DeepSeek 目前也没有宣布正式的私有化部署产品或收费服务。 过去 DeepSeek 开源模型后,部署适配更多由 SGLang、TensorRT-LLM 等推理框架和硬件厂商完成。这次官方主动留下大规模部署的直接联系方式,并表示会继续支持开源社区做新模型的推理适配,尝试进一步扩大部署范围。

09-10 06:43

DeepSeek开始模型和Agent一起训:V4.1 Flash为Harness专项优化

动察 Beating AI 快讯,DeepSeek Harness v0.1.5 发布。V4.1 Flash 在训练阶段就针对 Harness 做了专项训练和优化,覆盖标准、PTC 和极简三种模式。Harness 已经直接进入模型训练环节,不再只是模型发布后再接一个 Agent 外壳。 新版还加入实验性的 Agent Teams。父子 Agent 可以双向通信,主 Agent 能给不同子 Agent 指定模型和推理强度;多个 Agent 还能共享任务、互相发消息,最后由主 Agent 汇总。 V4.1 Flash 还有一个很特别的长任务优化:Agent 跑到一半修改系统提示词,也可以尽量保留已有 KV Cache。长任务不用因为前面的规则改了一点,就把后面大段上下文重新计算。 Web 端也加入文件上传和预览,支持 PDF、图片、代码等格式。插件可以往左右 Sidebar 和内容区接入自己的 UI,长会话的加载、恢复和内存占用也一起做了优化。

09-10 02:40

DeepSeek V4.1 Flash上线App:快速、专家、识图三合一

动察 Beating AI 快讯,DeepSeek V4.1 Flash 开始上线 App,原来的「快速」「专家」「识图」三个模式合并成一个入口。用户不用再手动选模式,一个模型同时处理日常对话、图片理解和复杂问题。 V4.1 Flash 原生支持多模态。DeepSeek 此前称,新模型在性能、费用、速度和总用时等指标上已经全面超过 V4 Pro,并将在 V4.1 Pro 上线前接管所有 V4 Pro 请求。

09-09 07:23

DeepSeek V4.1 Flash即将上线,官方称全面超过V4 Pro

动察 Beating AI 快讯,DeepSeek 计划在 9 月 10 日前后正式发布 V4.1 Flash。官方称,经过内部和外部测试,新模型在性能、费用、速度和总用时等指标上已经全面超过 V4 Pro。 V4.1 Flash 上线后,在 V4.1 Pro 发布之前,所有发往 V4 Pro 的请求都会自动切到 V4.1 Flash,并按更便宜的 Flash 价格计费。用户不需要修改原来的 V4 Pro 调用方式。