DeepSeek V4.1 Flash模型正式发布
相关推荐
DeepSeek开始模型和Agent一起训:V4.1 Flash为Harness专项优化
动察 Beating AI 快讯,DeepSeek Harness v0.1.5 发布。V4.1 Flash 在训练阶段就针对 Harness 做了专项训练和优化,覆盖标准、PTC 和极简三种模式。Harness 已经直接进入模型训练环节,不再只是模型发布后再接一个 Agent 外壳。 新版还加入实验性的 Agent Teams。父子 Agent 可以双向通信,主 Agent 能给不同子 Agent 指定模型和推理强度;多个 Agent 还能共享任务、互相发消息,最后由主 Agent 汇总。 V4.1 Flash 还有一个很特别的长任务优化:Agent 跑到一半修改系统提示词,也可以尽量保留已有 KV Cache。长任务不用因为前面的规则改了一点,就把后面大段上下文重新计算。 Web 端也加入文件上传和预览,支持 PDF、图片、代码等格式。插件可以往左右 Sidebar 和内容区接入自己的 UI,长会话的加载、恢复和内存占用也一起做了优化。
DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一
动察 Beating AI 快讯,Artificial Analysis 完成 DeepSeek V4.1 Flash 独立测试,综合智能指数拿到 40 分。它已经超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这套第三方榜单,DeepSeek 还没夺回国产模型第一。 但价格差距非常夸张。V4.1 Flash 跑完一个 Intelligence Index 任务平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差约 7 倍。输出速度达到 197 Token/s,也远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。 Agent 依然是它最强的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 也拿到 84%。缺点是它特别能说,AA 测试中单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,吃掉了一部分价格优势。
B.AI 宣布 DeepSeek-V4.1-Flash 多模态模型上线
ChainCatcher 消息,B.AI 平台宣布 DeepSeek 原生多模态 MoE 大模型 DeepSeek-V4.1-Flash 正式上线。该模型采用 5520 亿参数主干与 Causal Encoder-Decoder 架构,输入与输出采用非对称计算规模。模型支持 100 万 Token 上下文与 384K Output,面向长周期编程 Agent、多模态工作流与高并发 Agent 系统。目前 Web Chat 与 API 双端接入均已开放。
上游调价在即,B.AI 为开发者锁定 DeepSeek V4 Flash 专属福利
ChainCatcher 消息,距DeepSeek V4 Flash系列新价格生效(9月10日12:00 SGT)仅剩不到24小时。上游调价在即,B.AI 已经为全球开发者准备了一份专属叠加福利,确保顶尖算力依然触手可及。这份即将揭晓的福利,旨在进一步降低调用成本、释放更大生产力——无论是高频API调用、Agent工作流搭建,还是大规模生产级部署,都能以更低负担持续高效运转。具体福利即将公布,敬请密切关注B.AI官方动态,别错过这波算力加码。
DeepSeek将于明日下调Flash系列API价格
PANews 9月9日消息,据DeepSeek开放平台公告,DeepSeek将于北京时间9月10日12时起下调Flash系列模型调用价格。其中,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33.33%和11.11%。
DeepSeek-V4-Flash折扣优惠正式生效,B.AI同步峰谷定价再打5折
Odaily星球日报讯 9 月 3 日,B.AI 平台 DeepSeek-V4-Flash 与 DeepSeek-V4-Flash-Vision-Exp 折扣优惠正式生效,平台在 DeepSeek 官方峰谷定价机制基础上全线叠加 5 折优惠——高峰时段仅需官方原价 5 折,空闲时段低至官方高峰价 2.5 折,单次调用最高立省 75%,无论是高并发任务、Agent 工作流还是规模化 API 调用,B.AI 始终是开发者使用 DeepSeek-V4-Flash 最划算的选择。同时,GLM-5.3-Flash、Qwen3.8-Flash、Hy3 与 MiMo V2.5 四款热门模型依然 100% 免费开放,覆盖推理、多模态与中文场景等多元需求。