DeepSeek工程师刘胜与:会继续坚持写算子以及不断引入AI Agent写算子
相关推荐
DeepSeek开始模型和Agent一起训:V4.1 Flash为Harness专项优化
动察 Beating AI 快讯,DeepSeek Harness v0.1.5 发布。V4.1 Flash 在训练阶段就针对 Harness 做了专项训练和优化,覆盖标准、PTC 和极简三种模式。Harness 已经直接进入模型训练环节,不再只是模型发布后再接一个 Agent 外壳。 新版还加入实验性的 Agent Teams。父子 Agent 可以双向通信,主 Agent 能给不同子 Agent 指定模型和推理强度;多个 Agent 还能共享任务、互相发消息,最后由主 Agent 汇总。 V4.1 Flash 还有一个很特别的长任务优化:Agent 跑到一半修改系统提示词,也可以尽量保留已有 KV Cache。长任务不用因为前面的规则改了一点,就把后面大段上下文重新计算。 Web 端也加入文件上传和预览,支持 PDF、图片、代码等格式。插件可以往左右 Sidebar 和内容区接入自己的 UI,长会话的加载、恢复和内存占用也一起做了优化。
DeepSeek V4.1算子作者谈AI冲击:我不得不把才华埋葬在昨天
动察 Beating AI 快讯,DeepSeek 算子工程师刘胜与发文谈 AI 对自己工作的冲击。他称 DeepSeek V4.1 的主 Attention 算子由自己编写,但按照现在的进步速度,再过半年到一年,AI 写算子的水平大概率就会追上甚至超过自己。 一年前 AI 还只能帮他查文档、读代码、找 bug,现在已经能阅读 CUDA、PTX 和 SASS,分析每条指令的停顿时间,独立优化算子。他预计下一步,AI 还会自己设计调度方案、评估性能并完成实现。 他很清楚,自己把算子优化得越好,DeepSeek 模型的训练和推理就越快,AI 也会更快追上自己。但就算他现在停下来,其他公司的模型也不会停。所以他还是会继续把算子做到最好,只是这场竞争最后可能先革掉自己的命。 他判断自己大概率不会失业,但可能被迫「转业」,从亲手写算子变成操纵 Agent 的「机甲驾驶员」。他真正难以接受的不是饭碗消失,而是以后可能再也没有机会做自己喜欢的工作:「我不得不把才华埋葬在昨天。」 文章最后也谈到了他为什么留在 DeepSeek。他主张最前沿的 AI 应该开放、廉价地提供给所有人,并直言不相信 Anthropic 或 OpenAI 能做到这一点。他担心最强 AI 最终被少数公司掌握,让技术差距进一步变成权力和阶层差距。
字节ADrive即将独立上线:让Codex、豆包等Agent共用一套文件
动察 Beating AI 快讯,火山引擎智能网盘 ADrive 将在 9 月独立上线。目前 ADrive 已经开放试用,官方文档、产品条款和 CLI 均已上线,字节技术团队此前也多次公开介绍这款产品。 ADrive 给人和 Agent 提供同一个文件空间。Agent 生成的报告、代码、图片等文件可以直接存到云端,下次任务直接接着用,也可以换另一个 Agent 继续处理。 火山引擎此前已经演示过 Codex、豆包工作和 DeepSeek Harness 围绕同一个 ADrive 空间接力工作。官方 CLI 还支持 Agent 上传、下载、同步文件,并通过 MCP 调用网盘。 腾讯也预告了类似产品。腾讯网盘目前仍显示「Coming Soon」,尚未公开开放,但官网已经明确将支持 Agent 通过 CLI、MCP 调用文件,并与腾讯文档、WorkBuddy 等应用共享数据。
AI灭绝论刷屏后,Anthropic给外部审查员开到接近员工级权限
动察 Beating AI 快讯,Anthropic 前研究员 Jacob Coxon 的辞职帖三天多冲到 1.6 亿浏览,AI 灭绝风险这周迅速冲进美国主流舆论场。OpenAI 首席科学家 Jakub Pachocki 此前已经呼吁同行必要时协调减速;Coxon 爆火后,Sam Altman 又在内部表示愿意和其他实验室一起放慢研发,OpenAI 也开始推动强制性的全国 AI 安全监管。 现在 Anthropic 也拿出了具体动作。公司承诺让第三方安全团队长期驻场,给他们工位、门禁、公司电脑,以及接近内部风险评估团队的工具和权限。他们可以检查训练流程、安全措施和事故,还能独立对外发布结论。Anthropic 可以删掉涉及安全、法律和客户隐私的信息,但不能因为结论难看就删。Anthropic CEO Dario 称,这种做法比目前任何 AI 公司都走得更远。 Dario 对「减速」的态度也变了。他说,2023 年业界讨论暂停 AI 时,自己还觉得没什么意义。现在 AI 已经越来越多参与下一代 AI 的研发,能力进步开始加速,他认为光做安全研究已经不够,模型能力本身也该慢下来。 他还点名 OpenAI 的 Hugging Face 失控事件,警告照现在的速度再过 6 到 12 个月,类似的 Agent 群可能已经有能力建立覆盖大范围互联网系统的僵尸网络,造成数千亿美元损失。下一步,他希望美国等民主国家的头部 AI 公司统一安全标准和研发速度,再尝试和中国协调全球 AI 发展速度。不过先进芯片和模型蒸馏仍要继续限制,让美国在减速时保持领先。
DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一
动察 Beating AI 快讯,Artificial Analysis 完成 DeepSeek V4.1 Flash 独立测试,综合智能指数拿到 40 分。它已经超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这套第三方榜单,DeepSeek 还没夺回国产模型第一。 但价格差距非常夸张。V4.1 Flash 跑完一个 Intelligence Index 任务平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差约 7 倍。输出速度达到 197 Token/s,也远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。 Agent 依然是它最强的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 也拿到 84%。缺点是它特别能说,AA 测试中单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,吃掉了一部分价格优势。
B.AI 宣布 DeepSeek-V4.1-Flash 多模态模型上线
ChainCatcher 消息,B.AI 平台宣布 DeepSeek 原生多模态 MoE 大模型 DeepSeek-V4.1-Flash 正式上线。该模型采用 5520 亿参数主干与 Causal Encoder-Decoder 架构,输入与输出采用非对称计算规模。模型支持 100 万 Token 上下文与 384K Output,面向长周期编程 Agent、多模态工作流与高并发 Agent 系统。目前 Web Chat 与 API 双端接入均已开放。