ElevenLabs Music v2.5上线:免费版也给商用权,每天5首无损下载
相关推荐
Suno终于用上正版音乐,v6却被用户骂不如旧版
动察 Beating AI 快讯,AI 音乐平台 Suno 发布新一代模型 v6,包括 v6、v6-wild 和免费的 v6-mini,同时退役此前所有模型。v6 主打稳定和可控,v6-wild 更随机,偏实验。 这也是 Suno 第一次与 Warner Music、BMG、Believe 等音乐公司合作开发新模型,开始使用获得授权的音乐训练。此前 Warner 还曾起诉 Suno,Believe 也一度禁止发行 Suno 生成的歌曲。 但第一波用户口碑并不好。不少老用户抱怨 v6 比 v5、v5.5 声音更闷、人声更糊,歌曲也更同质化,甚至要求恢复旧模型。
FreeToken开源:一张5090跑DeepSeek-V4-Flash,最高25 Token/s
动察 Beating AI 快讯,伯克利、MIT 等研究者开源 FreeToken。这是一个专门为本地设备设计的 MoE(混合专家模型)推理引擎,主要解决超大模型显存装不下的问题。它会把部分权重放在系统内存,并让 CPU 和 GPU 一起参与推理。 FreeToken 会把模型的大量专家权重放在系统内存,只把一部分缓存在显存。遇到显存里没有的专家时,它会根据 PCIe 和 CPU 内存带宽,动态决定是把权重搬到 GPU,还是直接交给 CPU 计算。这样 CPU、GPU、系统内存和 PCIe 可以一起参与推理。 论文实测,一台配备 RTX 5090 的游戏台式机运行 284B 参数的 DeepSeek-V4-Flash,可以达到 22–25 Token/s。这款模型每生成一个 Token 实际只激活约 13B 参数,因此特别适合这种 CPU、GPU 混合推理。 FreeToken 还在 8GB 显存的 RTX 4060 笔记本上把 35B 模型跑到 39.3 Token/s;单张 96GB RTX PRO 6000 则可以运行 753B 参数的 GLM-5.2,速度达到 llama.cpp 的约两倍。项目目前支持超过 20 款 MoE 模型,并已采用 Apache 2.0 许可证开源。
Cursor上线Projects:一个Agent当项目经理,下面管数千个Agent
动察 Beating AI 快讯,Cursor 上线 Projects,把一个 Agent 干活升级成了「Agent 管 Agent」。每个项目都有一个协调 Agent,它自己不写代码,只负责拆任务、制定计划,再把活分给数千个子 Agent 并行完成。 Project 会长期保存代码库、研究结果和用户偏好,几个月后也能接着干。任务默认跑在云端,电脑关掉也不会停;需要本机测试时,再自动拉起本地 Agent。它还能盯着 Slack 和 PR,自动修 CI,有新任务就自己开工,不用等人再发 prompt。 这其实是 Cursor 此前多 Agent 实验的正式产品化。今年 1 月,它已经展示过数百个 Agent 同时协作,甚至从零写出一个超过 100 万行代码的浏览器。现在 Projects 已进入 beta,正逐步向所有用户开放。
Codex产品负责人:暂停200美元Pro计划新订阅
动察 Beating AI 快讯,OpenAI Codex 产品负责人 Tibo 表示,「OpenAI 为了确保现有用户能够获得出色的体验,并继续使用 Astra,我们将暂停每月 200 美元 Pro 计划的新订阅。该计划对我们的系统造成的压力最大,因此我们希望采取最小幅度的调整,以便继续为尽可能多的用户提供访问权限。 其他所有套餐以及 API 服务仍可正常使用。现有账户不会受到任何影响,我们正在尽快增加更多容量。」
DeepSeek V4.1 Flash即将上线,官方称全面超过V4 Pro
动察 Beating AI 快讯,DeepSeek 计划在 9 月 10 日前后正式发布 V4.1 Flash。官方称,经过内部和外部测试,新模型在性能、费用、速度和总用时等指标上已经全面超过 V4 Pro。 V4.1 Flash 上线后,在 V4.1 Pro 发布之前,所有发往 V4 Pro 的请求都会自动切到 V4.1 Flash,并按更便宜的 Flash 价格计费。用户不需要修改原来的 V4 Pro 调用方式。
Astra太抢手,OpenAI考虑暂停新Pro订阅
动察 Beating AI 快讯,OpenAI 核心产品负责人 Thibault Sottiaux 称,GPT-6 Astra 的需求「前所未见」。如果需求继续增长,OpenAI 可能暂停新的 ChatGPT Pro 订阅,优先保证现有用户的服务质量。