加密货币价格波动剧烈,本站内容仅供参考,不构成投资建议。投资有风险,可能导致全部损失。

查看完整免责声明
返回 7*24 快讯
来源MarsBit

阿里云宣布Qwen3-VL-Rerank模型降价

火星财经消息,阿里云公告,大模型服务平台百炼将于北京时间2026年8月31日10:13:53起,对北京地域Qwen3-VL-Rerank模型计费单价进行下调调整:将文本输入从0.7元/百万tokens下调至0.5元/百万tokens,多模态输入从1.8元/百万tokens下调至0.5元/百万tokens。(财联社)
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-02 02:44

阿里更新旗舰模型Qwen3.8-Max

火星财经消息,9月2日,阿里更新旗舰模型Qwen3.8-Max,性能较旧版本显著提升。在针对编程(Coding)和专业办公(Cowork)进行专项后训练后,Qwen3.8-Max新版本整体性能增强。在聚焦前端编程能力(WebDev)的全球权威三方榜单CodeArena中,提升22分至1691分,领先Claude Opus5、Kimi K3等一众模型,位居总榜第一。同时,CodeArena更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max新版本每百万Tokens综合平均仅5美元,直接“斩杀”所有价格大于5美元的其他模型。据了解,Qwen3.8-Max是阿里千问迄今最强大的大语言模型,总参数达2.4万亿,支持100万上下文Tokens;更新后的Qwen3.8-Max涌现出更强的智能体编程能力,更适合企业真实复杂任务、科研、长周期任务等。(财联社)

08-14 15:36

AMD宣布为阿里千问模型Qwen3.8 27B提供“Day 0”支持

Odaily星球日报讯 AMD 宣布为阿里通义千问(Qwen)最新一代模型 Qwen3.8 27B 提供“Day 0”支持,开发者可在模型发布当天即可通过 AMD 硬件本地运行该大规模开源 AI 模型。 AMD 表示,Qwen3.8 27B 是一款适合本地 AI 开发的 27B 参数密集型模型,延续 Qwen 系列在代码生成、实际工作任务、科研以及长上下文 AI 应用方面的优化方向。该模型可通过开源推理框架 llama.cpp 运行于搭载 AMD 处理器的 AI PC 和工作站,或单张 AMD 32GB 显卡上,同时支持具备超过 24GB 可变显存(VGM)或显存容量的 AMD 硬件平台。 AMD 初步测试显示,Qwen3.8 27B 在 AMD 平台上具备较高本地推理性能:在 AMD Ryzen AI Max+ 395 处理器上,最高可达到 24.5 tokens/秒;在单张 Radeon AI PRO R9700 GPU 上,最高可达到 51.8 tokens/秒。测试基于 Windows 系统、llama.cpp Vulkan 后端,并启用多令牌预测(MTP)优化。AMD 表示,随着后续软件和模型优化推进,实际性能仍有提升空间。

09-18 13:55

PrismML把Qwen3.8 27B压到5.9GB,自测保留98.2%性能

动察 Beating AI 快讯,加州理工学院数学家 Babak Hassibi 联合创立的 AI 实验室 PrismML 发布 Ternary Bonsai 2 27B,把 Qwen3.8 27B 的 270 亿参数模型压到 5.9GB。它把权重压成 -1、0、+1 三种值,体积只有 FP16 原版约九分之一。模型支持 26.2 万 Token 上下文、图文输入和 Agent 工具调用,并以 Apache 2.0 许可开放权重。 相比两个月前的第一代 Bonsai 27B,新版体积基本没变,但底模从 Qwen3.6 换成了 Qwen3.8。PrismML 自测称,综合基准成绩相对完整版的保留率从约 95% 提到 98.2%,其中数学和代码成绩已经非常接近原版。官方还演示了它在 RTX 5090 上直接跑 Cline 编程 Agent 和 Computer Use。

09-18 04:03

Qwen3.8-Omni-Flash上线:自己看视频、调工具、交成片

动察 Beating AI 快讯,阿里千问上线原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图片、音频、视频和 1M 上下文。 这代明显加强了音视频 Agent 能力。模型可以自己从视频里找信息、规划任务,再调用外部工具完成剪辑、配音和渲染。官方展示了长会议处理、短剧翻译、电影解说、MV 制作和视频转图文笔记等场景。 面对几小时的长视频,它也不用从头到尾全部处理。模型会先判断答案可能在哪,再逐步定位关键片段。OmniVideoBench 上,准确率从 63.4 提到 67.8,Token 消耗从 145,736 降到 79,117,少了 45.7%。 千问称,Qwen3.8-Omni-Flash 在 30 项评测上的平均成绩比 Qwen3.5-Omni-Plus 提升超过 26%,音视频能力接近 Gemini 3.8 Flash,音频能力整体超过后者。音频输入成本下降超过 98%,音视频输入下降超过 93%。 目前 Qwen3.8-Omni-Flash 模型权重尚未公开,只开放了 API。千问同时开源了 Qwen-MM-Plugins,可以装进 Claude Code、Codex、Gemini CLI、Qwen Code 等 Agent,给它们补上图片、音频、长视频处理和视频剪辑能力。 另一套 Qwen-Live Harness 更像实时调度层。用户可以直接和实时全模态模型说话,再把复杂任务交给 Gemini CLI、Claude Code、Codex 等后台 Agent 持续执行。它会跟踪任务进度,做完后再主动回来告诉你结果。

09-15 13:53

B.AI 热门模型权益更新,Qwen3.8-Flash 等三款模型将开启 1 折特惠调用

ChainCatcher 消息,B.AI 平台宣布,为向全球开发者提供长期稳定、高吞吐的算力支持,将于 9 月 16 日 17:00(SGT)起对 Qwen3.8-Flash、Hy3 及 MiMo-V2.5 三款热门模型正式开启 1 折特惠调用,上述模型的免费权益将于 9 月 16 日 16:59(SGT)结束。 届时开发者仅需支付标准价格的 10%,即可继续以极低成本享受高品质算力服务。B.AI 提醒广大开发者提前做好余额准备,确保 API 调用与项目工作流平滑衔接。

09-01 09:51

Qwen27B改成扩散Agent:速度拉到500+Token/s,厂商自测单项超Sol

动察 Beating AI 快讯,专攻超高速大模型的 Celeris 发布一款基于 Qwen3.8-27B 改出来的混合扩散 Agent 模型 Celeris-1 Magnus,官方称在不少场景能跑到 500+ Token/s。 在 τ³-Banking 的 97 个银行客服任务上,Magnus 开启 low reasoning 后完成率达到 41.2%,中位耗时 55 秒。同场的 GPT-5.6 Sol 是 38.1%、79 秒。 传统模型基本一个 Token 一个 Token 往后写,Magnus 能一次生成多个 Token,再反复修正。需要严格按顺序生成的内容再串行处理,因此一次计算可以往前推进更多 Token。