黄仁勋:AI 模型蒸馏是竞争,不是盗窃
相关推荐
外媒:中国监管部门正在调查DeepSeek与Moonshot
PANews 9月22日消息,据The Information报道,中国监管部门正在调查国产大模型公司 DeepSeek 与 Moonshot(月之暗面),以核查其是否在与美国 AI 公司 Anthropic 的合作或交流中存在用户数据或敏感信息外泄风险。
DeepSeek工程师刘胜与:会继续坚持写算子以及不断引入AI Agent写算子
火星财经消息 9月15日,DeepSeek机器学习系统(MLSys)工程师刘胜与发布对《我不得不把才华埋葬在昨天》的补充说明。“我写这篇文章本来的目的,并非要表达对失业的焦虑,更不是想强调DeepSeek的开放普惠与Anthropic的不讨喜,而是想和我过去手写算子的那段时光说句再见。”他表示,对于他未来能不能长久地把一件事情同时作为工作和爱好是悲观的,不过还是会继续坚持写算子、以及不断引入AI Agent写算子。此前,刘胜与在《我不得不把才华埋葬在昨天》一文中给出判断,等到AI写算子的水平高于他的那天,他不至于会“失业”,但必须要“转业”,需要放弃他深耕已久并充满热爱的算子设计、编写、优化领域,转而去做Agent的“机甲驾驶员”。(广角观察)
DeepSeek V4.1算子作者谈AI冲击:我不得不把才华埋葬在昨天
动察 Beating AI 快讯,DeepSeek 算子工程师刘胜与发文谈 AI 对自己工作的冲击。他称 DeepSeek V4.1 的主 Attention 算子由自己编写,但按照现在的进步速度,再过半年到一年,AI 写算子的水平大概率就会追上甚至超过自己。 一年前 AI 还只能帮他查文档、读代码、找 bug,现在已经能阅读 CUDA、PTX 和 SASS,分析每条指令的停顿时间,独立优化算子。他预计下一步,AI 还会自己设计调度方案、评估性能并完成实现。 他很清楚,自己把算子优化得越好,DeepSeek 模型的训练和推理就越快,AI 也会更快追上自己。但就算他现在停下来,其他公司的模型也不会停。所以他还是会继续把算子做到最好,只是这场竞争最后可能先革掉自己的命。 他判断自己大概率不会失业,但可能被迫「转业」,从亲手写算子变成操纵 Agent 的「机甲驾驶员」。他真正难以接受的不是饭碗消失,而是以后可能再也没有机会做自己喜欢的工作:「我不得不把才华埋葬在昨天。」 文章最后也谈到了他为什么留在 DeepSeek。他主张最前沿的 AI 应该开放、廉价地提供给所有人,并直言不相信 Anthropic 或 OpenAI 能做到这一点。他担心最强 AI 最终被少数公司掌握,让技术差距进一步变成权力和阶层差距。
美国指控DeepSeek、Moonshot AI等中国AI企业“大规模恶意蒸馏”美国技术
PANews 9月9日消息,据路透社报道,美国执法和情报官员指控DeepSeek、Moonshot AI及阿里巴巴等6家中国AI企业,通过“蒸馏”方式利用OpenAI、Anthropic、Google及SpaceX等美国企业模型训练自身产品,并称相关行为可能在中国政府知情下进行,同时警告其可能增强中国军事及网络攻击能力。
CNBC:AI巨头密集上新模型引发“模型疲劳”
PANews 9月6日消息,据CNBC报道,Anthropic、OpenAI、Meta、Google本周密集发布多款大模型和升级版本,市场出现“模型疲劳”现象。Anthropic推出Claude Fable 5.1与Claude Mythos 5.1,Meta发布Muse Spark 1.3,Google上线Gemini 3.8 Flash,OpenAI则发布主打网络安全和计算机能力的GPT-6 Astra。与此同时,Nvidia宣布以129亿美元收购开源AI平台Hugging Face,并持续推出开源模型。
DeepSeek-V4-Flash折扣优惠正式生效,B.AI同步峰谷定价再打5折
Odaily星球日报讯 9 月 3 日,B.AI 平台 DeepSeek-V4-Flash 与 DeepSeek-V4-Flash-Vision-Exp 折扣优惠正式生效,平台在 DeepSeek 官方峰谷定价机制基础上全线叠加 5 折优惠——高峰时段仅需官方原价 5 折,空闲时段低至官方高峰价 2.5 折,单次调用最高立省 75%,无论是高并发任务、Agent 工作流还是规模化 API 调用,B.AI 始终是开发者使用 DeepSeek-V4-Flash 最划算的选择。同时,GLM-5.3-Flash、Qwen3.8-Flash、Hy3 与 MiMo V2.5 四款热门模型依然 100% 免费开放,覆盖推理、多模态与中文场景等多元需求。