B.AI 宣布 DeepSeek-V4-Flash 将于 8 月 17 日全量免费开放
相关推荐
DeepSeek-V4-Pro被曝「一个API三个模型」?社区测试揭示背后或是Agent环境差异
BlockBeats 消息,8 月 15 日,近日 AI 社区热议 DeepSeek-V4-Pro 疑似存在多个版本。有用户发现,同样调用 deepseek-v4-pro 接口,在更换 IP 或重新创建会话后,模型会出现三种不同的「推理风格」: 一类频繁以「Let me」开头,接近此前 V4 Pro Preview;一类常出现「The user wants me」,类似 V4 Flash;另一类大量使用「we」,被部分用户称为能力更强的「神版 V4 Pro」。 由于同一会话一旦进入某种模式后,后续表现通常保持稳定,社区一度猜测 DeepSeek 是否在 API 背后隐藏了多个模型,并通过路由机制分发。不过,进一步分析 DeepSeek Harness 源码后,出现了另一种解释:差异可能并非来自不同模型权重,而是来自 Agent 运行环境。 社区发现,8 月 10 日,DeepSeek Harness 官方仓库更新了一条关键 commit: 「fix(preset): align minimal agent with RL composition」 该更新旨在让 Minimal Agent 与强化学习(RL)训练时使用的 Agent 环境保持一致。 官方文档显示,Minimal preset 包含极简 system prompt、persistent Bash 环境、指定编辑工具、RL 训练使用的 compaction policy,并移除了额外身份提示、Web 提示及工具说明。 这意味着,DSH Minimal 可能并不是 Standard 版本的「阉割版」,而是在模拟模型训练阶段真实接触的 Agent 环境。 社区测试也支持这一观点。同一个 DeepSeek V4 Pro 在不同 Harness 环境下表现: DSH Standard:91 分; DSH PTC:92 分; DSH Minimal:99/96 分。 随后,测试者开发「Anchored Standard」插件:首次请求模拟 Minimal 环境,只开放 shell 和 read 工具,完成首次工具调用后再恢复 Standard 完整工具集,结果连续获得 98/99 分。 测试者认为,决定 V4 Pro Agent 能力发挥的关键,可能并非最终拥有多少工具,而是模型首次看到的:System Prompt + Tool Schema + Agent
DeepSeek没把新版能力锁在API,V4-Flash正式版权重开源
据动察 Beating 监测,DeepSeek 已在 Hugging Face 放出 V4-Flash-0731 正式版权重,并继续采用 MIT 许可证。开发者可以自行部署、微调和商用,不必只能通过 DeepSeek 官方 API 使用。 这次开放的是刚完成后训练升级的正式版。它在多项 Agent 测试中超过 V4-Pro-Preview,相关能力现在也能由第三方独立部署和复测。
国家超算互联网上线 DeepSeek-V4-Flash API,一键接入可调用
火星财经消息,据 IT 之家报道,国家超算互联网正式上线 DeepSeek-V4-Flash-0731 模型 API 调用服务和模型文件。该版本经大量后训练,智能体与指令遵循能力大幅增强,多项基准测试性能可与最强闭源模型媲美。企业和开发者无需环境配置,一键接入即可调用。平台 AI 社区已汇集 1700 余款开源大模型,并成为全国首个十万卡级超智融合算力资源池。
DeepSeek:DeepSeek-V4-Flash正式版API上线公测,DeepSeek-V4-Pro正式版将会尽快发布
PANews 7月31日消息,DeepSeek发布更新日志,DeepSeek-V4-Flash 正式版 API 上线公测。DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。DeepSeek-V4-Pro 正式版将会尽快发布。
「韩模之光」Solar Pro4智能指数冲到42分,但还是打不过DeepSeek V4Flash
据动察 Beating 监测,韩国 AI 公司 Upstage 发布旗舰推理模型 Solar Pro 4。Artificial Analysis 最新评测中,它的智能指数从上一代 Solar Pro 3 的 14 分冲到 42 分,主要提升来自 Agent 和长上下文能力。 其中 Terminal-Bench v2.1 从 12% 升到 57%,长上下文推理从 31 升到 71。GDPval-AA v2 也从 498 Elo 升到 1277,超过 1000 的人类基线。Solar Pro 4 已经是韩国模型冲击全球前列的一张代表牌。 但放到 DeepSeek V4 Flash 0731 面前,还是不够看。同一套 Artificial Analysis 智能指数里,DeepSeek 拿到 52 分,比 Solar Pro 4 高 10 分。DeepSeek 每秒输出约 122 个 Token,Solar Pro 4 约 65 个,前者接近快一倍。 价格差距更大。Solar Pro 4 每百万 Token 输入、输出分别要 0.30 和 1.20 美元,DeepSeek 只要 0.14 和 0.28 美元。Solar 的输出价格超过 DeepSeek 的 4 倍。 至少按这套综合评测和 API 性价比,「韩模之光」还没追上 DeepSeek。
B.AI 平台全面上线 DeepSeek V4 正式版
ChainCatcher 消息,B.AI 平台正式宣布 DeepSeek V4 系列 Web Chat 及 API 全线升级至最新正式版,涵盖 V4-Flash-0731 与 V4-Pro-0813 两大版本。其中,V4-Flash-0731 在保持原有高效架构与模型规模的基础上,通过专项后训练全面强化了 Agent 协同、代码生成及多工具调用能力,执行效率与任务完成度明显提升;V4-Pro-0813 则在 DeepSWE、CyberGym 等测试成绩显著提升,进一步巩固了其在复杂工程与智能体任务中的领先优势。 两款模型均沿用原有模型 ID 和调用接口,开发者无需任何配置变更即可无缝切换,延续一贯的兼容性与稳定性。即日起,新版能力已全面开放体验,欢迎登录 B.AI 平台立即使用。