GLM-5.3、DeepSeek-V4-Pro正式版接入千问AI平台
相关推荐
“千问办公”首发上线GLM-5.3、DeepSeek V4 Pro两款模型
火星财经消息,8月15日,阿里巴巴旗下Agent产品“千问办公”首发上线GLM-5.3和DeepSeek V4 Pro两款前沿模型。即日起,用户可在产品首页的“前沿模型”档位直接选用。加上此前首发上线的Qwen3.8-Max,千问办公目前已支持三款国产旗舰模型。
DeepSeek-V4-Pro被曝「一个API三个模型」?社区测试揭示背后或是Agent环境差异
BlockBeats 消息,8 月 15 日,近日 AI 社区热议 DeepSeek-V4-Pro 疑似存在多个版本。有用户发现,同样调用 deepseek-v4-pro 接口,在更换 IP 或重新创建会话后,模型会出现三种不同的「推理风格」: 一类频繁以「Let me」开头,接近此前 V4 Pro Preview;一类常出现「The user wants me」,类似 V4 Flash;另一类大量使用「we」,被部分用户称为能力更强的「神版 V4 Pro」。 由于同一会话一旦进入某种模式后,后续表现通常保持稳定,社区一度猜测 DeepSeek 是否在 API 背后隐藏了多个模型,并通过路由机制分发。不过,进一步分析 DeepSeek Harness 源码后,出现了另一种解释:差异可能并非来自不同模型权重,而是来自 Agent 运行环境。 社区发现,8 月 10 日,DeepSeek Harness 官方仓库更新了一条关键 commit: 「fix(preset): align minimal agent with RL composition」 该更新旨在让 Minimal Agent 与强化学习(RL)训练时使用的 Agent 环境保持一致。 官方文档显示,Minimal preset 包含极简 system prompt、persistent Bash 环境、指定编辑工具、RL 训练使用的 compaction policy,并移除了额外身份提示、Web 提示及工具说明。 这意味着,DSH Minimal 可能并不是 Standard 版本的「阉割版」,而是在模拟模型训练阶段真实接触的 Agent 环境。 社区测试也支持这一观点。同一个 DeepSeek V4 Pro 在不同 Harness 环境下表现: DSH Standard:91 分; DSH PTC:92 分; DSH Minimal:99/96 分。 随后,测试者开发「Anchored Standard」插件:首次请求模拟 Minimal 环境,只开放 shell 和 read 工具,完成首次工具调用后再恢复 Standard 完整工具集,结果连续获得 98/99 分。 测试者认为,决定 V4 Pro Agent 能力发挥的关键,可能并非最终拥有多少工具,而是模型首次看到的:System Prompt + Tool Schema + Agent
值得买科技OpenHubs首批上线Qwen3.8-Max
火星财经消息 8月3日,阿里云正式发布Qwen3.8-Max大模型,值得买科技一站式大模型服务平台OpenHubs同步上线Qwen3.8-Max。OpenHubs平台通过统一账号体系、标准化API接口和集中化管理能力,实现主流大模型的统一接入、调用、监控、统计与账单管理。据了解,此前OpenHubs已率先上线月之暗面最新旗舰模型Kimi K3,并已汇聚Qwen、Kimi、DeepSeek、智谱GLM、MiniMax、豆包Seed等主流大模型。(广角观察)
DeepSeek:DeepSeek-V4-Flash正式版API上线公测,DeepSeek-V4-Pro正式版将会尽快发布
PANews 7月31日消息,DeepSeek发布更新日志,DeepSeek-V4-Flash 正式版 API 上线公测。DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。DeepSeek-V4-Pro 正式版将会尽快发布。
DeepSeek V4 Pro跑5套Harness:Pi成功率第一,DSH最省钱
动察 Beating AI 快讯,Agent 工具公司 Composio 把同一个 DeepSeek V4 Pro 0813 分别放进 Pi Agent、DeepSeek Harness 0.1、Claude Code、OpenCode 和 Hermes Agent,统一开到 max reasoning,跑了 30 个多步骤 Agent 任务。 通过率: 1. Pi Agent:21/30 2. DeepSeek Harness:20/30 3. Claude Code:19/30 4. OpenCode:19/30 5. Hermes Agent:18/30 30 道题里,15 道五家全过,7 道五家全挂。剩下 8 道只换了 Harness,结果就会翻转。 速度排名: 1. Claude Code:181.8 秒 2. DeepSeek Harness:252.1 秒 3. Hermes Agent:273.6 秒 4. OpenCode:280.6 秒 5. Pi Agent:362.9 秒 单次成功成本: 1. DeepSeek Harness:0.028 美元 2. Pi Agent:0.031 美元 3. OpenCode:0.032 美元 4. Hermes Agent:0.037 美元 5. Claude Code:0.074 美元 Pi 通过率最高,DeepSeek 官方 Harness 最省钱,Claude Code 最快但最贵。 Composio 此前用 DeepSeek V4 Flash 做过同类测试,当时 Pi 同样拿到最高通过率。
DeepSeek发布API调价公告
火星财经消息,DeepSeek发布API调价公告,将对 DeepSeek API 价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间 9:00-12:00、14:00- 18:00(其余为空闲时段)。新价格将于北京时间 2026年8月17日 00:00开始生效。deepseek-v4-pro高峰时段百万tokens输出,最高价格达27元。 (科创板日报记者 黄心怡)