加密货币价格波动剧烈,本站内容仅供参考,不构成投资建议。投资有风险,可能导致全部损失。

查看完整免责声明
返回 7*24 快讯
来源MarsBit

阿里千问发布 Qwen-Image-3.0

火星财经消息 7月21日,阿里发布最新图像生成基础模型Qwen-Image-3.0,这也是千问图像生成和编辑模型系列的第三代基础模型。新模型支持最大4.5k token超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂UI界面,同时支持12国语言和20多款字体原生渲染。(广角观察)
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-20 13:04

Qwen开源图像模型Qwen-Image-2.1,生成编辑一体

PANews 9月20日消息,据Qwen官方博客,阿里千问团队开源图像模型Qwen-Image-2.1,视觉生成部分仅7B参数,将文生图与图像编辑整合进同一模型,原生支持透明图像生成与编辑,最多可输入10张参考图完成多图合成,支持圈选、涂抹等局部编辑方式,并增强人像与商品编辑保真度及文字排版效果。

09-01 09:51

Qwen27B改成扩散Agent:速度拉到500+Token/s,厂商自测单项超Sol

动察 Beating AI 快讯,专攻超高速大模型的 Celeris 发布一款基于 Qwen3.8-27B 改出来的混合扩散 Agent 模型 Celeris-1 Magnus,官方称在不少场景能跑到 500+ Token/s。 在 τ³-Banking 的 97 个银行客服任务上,Magnus 开启 low reasoning 后完成率达到 41.2%,中位耗时 55 秒。同场的 GPT-5.6 Sol 是 38.1%、79 秒。 传统模型基本一个 Token 一个 Token 往后写,Magnus 能一次生成多个 Token,再反复修正。需要严格按顺序生成的内容再串行处理,因此一次计算可以往前推进更多 Token。

08-05 02:18

Qwen-Image-3.0上线千问AI平台

火星财经消息,据阿里云消息,阿里巴巴千问图像生成模型Qwen-Image-3.0正式上线千问AI平台,面向所有用户全部开放。旗舰版Qwen-Image-3.0-Pro与标准版Qwen-Image-3.0-Standard同时开放API,文生图0.18元/张起。API已在千问AI平台上线,海外用户可通过Qwen Cloud接入。

08-04 09:38

阿里云:Qwen-Image-3.0正式上线千问AI平台

PANews 8月4日消息阿里巴巴千问图像生成模型Qwen-Image-3.0正式上线千问AI平台,面向所有用户全部开放。旗舰版Qwen-Image-3.0-Pro与标准版Qwen-Image-3.0-Standard同时开放API,API已在千问AI平台上线,海外用户可通过QwenCloud接入。

07-19 11:39

阿里云推个人版 Token Plan,开放 Qwen3.8-Max 预览体验

PANews 7月19日消息,阿里云正式发布 Token Plan 个人版,开放 Qwen3.8-Max-Preview 体验。Qwen3.8-Max 参数量达 2.4T,主攻代码工程和专业办公场景,正式版将于近期发布并开源。个人版订阅限时优惠为:Lite 39元/月、Standard 139元/月、Pro 499元/月;团队版标准、高级、尊享席位价格分别为 150元、550元、1398元/席位/月。活动期间,Qwen3.8-Max-Preview 白天 Credits 消耗 1 折,个人版 Token Plan 夜间在此基础上再享 2 折。

09-19 08:22

DFlash团队进军Mac,27B模型跑到144Token/s

动察 Beating AI 快讯,Inco AI 开源本地推理引擎 Splash,把 Qwen3.8-27B 在 M5 Max MacBook Pro 上跑到了最高 144 Token/s。LM Studio 随即接入,0.4.25 版本已经可以直接使用。 Inco 此前做出的 DFlash 已经进入 SGLang、vLLM、TensorRT-LLM 和 llama.cpp。Meta、NVIDIA、小米、Poolside 等也给自家模型配了 DFlash 加速小模型。DFlash 会先让小模型并行猜出多个 Token,再交给大模型批量验证,减少逐 Token 生成的计算。 Splash 把这种优化扩到了整个本地推理引擎。它目前只支持 Qwen3.8-27B 和 Qwen3.6-35B-A3B,每个模型都单独配了 GPU kernel、内存方案和 DFlash 2 小模型。覆盖的模型少,但换来了更激进的性能优化。 144 Token/s 是 M5 Max 上的最高演示值。换到 Inco 用来做横向测试的 48GB M5 Pro,Qwen3.8-27B 单路短上下文达到 74 Token/s;4 路并发时总吞吐达到 170 Token/s,是第二名的 3.9 倍。这也是 Splash 更适合 Agent 场景的地方。一个 Agent 同时拉起多个子任务时,并发总吞吐往往比单条对话速度更重要。 Splash 本身开源,不绑定 LM Studio。目前需要 M3 或更新的 Mac、macOS 26.4 以上、至少 36GB 统一内存。