返回 7*24 快讯
来源MarsBit

阿里更新旗舰模型Qwen3.8-Max

火星财经消息,9月2日,阿里更新旗舰模型Qwen3.8-Max,性能较旧版本显著提升。在针对编程(Coding)和专业办公(Cowork)进行专项后训练后,Qwen3.8-Max新版本整体性能增强。在聚焦前端编程能力(WebDev)的全球权威三方榜单CodeArena中,提升22分至1691分,领先Claude Opus5、Kimi K3等一众模型,位居总榜第一。同时,CodeArena更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max新版本每百万Tokens综合平均仅5美元,直接“斩杀”所有价格大于5美元的其他模型。据了解,Qwen3.8-Max是阿里千问迄今最强大的大语言模型,总参数达2.4万亿,支持100万上下文Tokens;更新后的Qwen3.8-Max涌现出更强的智能体编程能力,更适合企业真实复杂任务、科研、长周期任务等。(财联社)
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-03 05:34

Anthropic升级Claude Code/Cowork,可后台操控用户Mac

PANews 9月3日消息,据IT之家报道,Anthropic宣布升级Claude Cowork和Claude Code的电脑控制功能,可在后台操控用户Mac。在macOS 15及以上系统中,用户处理其他工作期间Claude可在后台通过屏幕交互完成点击、输入和导航操作,用户可在设置中调整为“完全控制”模式。该功能同时服务于Cowork(文档处理、文件整理等知识工作)和Code(开发任务)两个产品,目前仅限Pro和Max个人订阅用户,Team和Enterprise计划尚未开放。

08-07 06:55重要

B.AI 本周福利持续更新,1 折调用通道上线,Qwen3.8-Max 免费开放

ChainCatcher 消息,B.AI 本周迎来多项重磅更新。 福利方面,新用户凭 Bitget Wallet、Binance Wallet 或 imToken 钱包一键登录,立领 100 万 免费 Credits;通过邀请码登录再得 30 万,叠加专属钱包登录礼累计最高 130 万,邀请人同步享有好友充值及订阅永久返利。充值优惠同步释放,BNB Chain 渠道专享 1:1 等额配额赠送,其他多种支付方式享 1:0.5 返赠,单用户最高可获 $100 等值积分。 模型侧再迎新突破,「自选服务商」阵容本周重磅扩容,新增 Nebula 渠道,推出低至 1 折的历史性调用折扣;同时,阿里通义千问旗舰模型 Qwen3.8-Max 正式登陆平台,现已开放限时免费体验。目前,自选模式已全面覆盖 Claude、GPT、Gemini 等全球主流大模型系列,叠加充值赠送与多档折扣,持续为全球开发者与企业用户释放极致算力性价比。

07-25 12:10重要

Claude Opus5在浏览器场景下几乎免疫提示词注入攻击,129项测试场景中无一被攻破

据 动察 Beating 监测,Anthropic 在 Claude Opus 5 系统卡中披露,该模型在浏览器智能体场景中几乎免疫提示词注入攻击,在 129 项测试场景中无一被攻破。这一突破意义重大,OpenAI 去年 12 月曾公开承认提示注入可能永远无法被完全解决。在安全公司 Gray Swan 的通用提示注入基准测试中,15 次攻击后 Opus 5 的成功率仅为 2.0%,大幅优于前代 Opus 4.8 的 5.5%,也领先于 Mythos 5 的 2.6% 和 Fable 5 的 2.8%。 提示注入被视为 AI 代理面临的最严重安全漏洞——攻击者通过在网页中嵌入隐藏文字等被操纵的输入内容,绕过模型指令执行恶意操作。零攻击率仅在开启 Auto Mode 的 Claude Cowork 等产品中实现。这一成果标志着 AI 代理安全性从「持续修补」迈入「结构性防御」阶段。 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。

08-30 13:11

传豆包2.2延期:字节补课Coding,招聘直接点名Claude Code、Codex

动察 Beating AI 快讯,字节原计划 8 月发布的豆包 2.2 推迟了。字节准备多花一些时间训练,重点补 Coding、工具调用和 Agent。 字节今年给 Seed 定的目标之一,就是把 Coding 做到第一梯队。内部希望年底前能做出类似 GLM-5.2、Kimi-K3 那种效果,让开发者真正开始认可字节的 Coding 模型。 8 月,Seed 刚做完一次大调整。原本按文本、语音、代码、视觉划分的团队被重新拆开,变成 Pretrain Data、Horizon RL、Product Posttrain-Work 和 Product Posttrain-Chat 四个部门。Horizon RL 会负责 Coding 后训练,Work 团队则重点做工具调用、GUI 操作和长任务执行。 字节最近也在密集招这方面的人。官网正在招 Code Agent、通用 Agent 和强化学习算法工程师。一份 Multi-Agent Harness 岗位甚至直接写明,要研究 Claude Code、Codex 等 Coding Agent,还要搭建能连续跑很久的多 Agent 和强化学习环境。 Seed 2.1 在 6 月发布时就已经重点强调 Coding,但字节显然觉得还不够。豆包 2.2 这次宁愿晚一点,也想先把 Coding 补得更像样。

08-25 10:24

减少Claude依赖,路透社转向阿里Qwen大模型

火星财经消息 8月25日,据报道,国际知名新闻机构汤森路透(路透社母公司)近日推出了其自研大模型Thomson-1。该模型基于阿里Qwen大模型开发,旨在降低对Claude等闭源模型的依赖并减少长期使用成本。Thomson-1将首先用于表格分析、文档审核等专业工作,并逐步承接部分此前由Claude完成的任务。(广角观察)

08-07 02:28

千问大版本功能上新:推出思考研究、定时任务与办公助理,支持旗舰模型Qwen3.8-MAX

据 动察 Beating 监测,千问今日宣布重大功能升级,推出思考研究、定时任务、办公助理、语音通话及智能体广场等多项新功能,同步支持最新旗舰模型 Qwen3.8-MAX。思考研究模式在原深度思考基础上升级,强化复杂推理、工具调用与结构化输出能力,可基于用户提供的背景资料直接生成结构清晰的完整文档。定时任务功能允许用户预设执行时间,由千问自动完成行业简报梳理、邮件分类汇总等周期性工作,每日定时推送核心信息。 办公助理功能可连接用户的备忘录、日历及邮件等应用,操作电脑和浏览器完成查资料、下载附件等多步骤任务,最终直接输出 Office 文档、应用和网站等成品,支持手机与 PC 跨端协同。语音通话能力实现 7×24 小时在线,覆盖互动陪玩、睡前故事、带娃讲题、语音打车等场景。智能体广场首批上线智能寄件、网盘整理、超清扫描等服务,覆盖物流、房产、本地生活、理财、汽车等十余个领域。此次升级标志着千问从对话式 AI 助手向可执行多步骤复杂任务的生产力平台全面进化。 点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。