PrismML发布Bonsai 27B,270亿参数AI模型首次适配iPhone
相关推荐
阿里云推个人版 Token Plan,开放 Qwen3.8-Max 预览体验
PANews 7月19日消息,阿里云正式发布 Token Plan 个人版,开放 Qwen3.8-Max-Preview 体验。Qwen3.8-Max 参数量达 2.4T,主攻代码工程和专业办公场景,正式版将于近期发布并开源。个人版订阅限时优惠为:Lite 39元/月、Standard 139元/月、Pro 499元/月;团队版标准、高级、尊享席位价格分别为 150元、550元、1398元/席位/月。活动期间,Qwen3.8-Max-Preview 白天 Credits 消耗 1 折,个人版 Token Plan 夜间在此基础上再享 2 折。
PrismML把Qwen3.6压到4GB,27B模型塞进iPhone
据动察 Beating 监测,加州理工学院数学家 Babak Hassibi 联合创立的 AI 实验室 PrismML 表示,已把阿里开源模型 Qwen3.6-27B 压缩后跑在 iPhone 17 Pro 上。 Qwen3.6-27B 是 270 亿参数稠密模型。推理时所有参数都会参与,不是只激活部分参数的 MoE 模型。 PrismML 称,模型大小从约 54GB 压到不到 4GB,性能没有明显下降。它可用于复杂对话、推理、Agent 和代码任务。 苹果已经和 PrismML 接触,讨论如何使用这项技术。苹果一直想把更多 AI 放到设备本地,但高级 Siri 仍依赖云端模型。
蚂蚁开源Ling-3.0-tiny:79亿参数,M4Pro本地跑到90Token/s
据动察 Beating 监测,蚂蚁百灵正式开放 Ling-3.0-tiny 权重,提供 BF16、FP8 和 INT4 三个版本,Hugging Face 页面标注为 MIT 许可。模型共有 79 亿参数,每个 Token 只激活 13 亿,主要面向本地部署和 Agent 场景。 Ling-3.0-tiny 有 128 个路由专家,每个 Token 只选择其中 8 个,再加 1 个所有 Token 都会使用的共享专家。注意力部分采用 3:1 的 KDA 与 MLA 混合架构,也就是每 3 层 Kimi Delta Attention 后接 1 层 MLA。 官方称 FP8 版在 M4 Pro MacBook 上可达到约 86–90 Token/s;DGX Spark 上约为 100–105 Token/s。
机构:预估iPhone 18 Pro成本大增近40%,苹果或调整毛利策略以稳健出货
火星财经消息,8 月 10 日,根据 TrendForce 集邦咨询最新手机产业研究,由于以存储器为首的零部件价格上涨,推升 Apple(苹果)将发布的 iPhone 18 系列整机成本。 TrendForce 集邦咨询预估第三季 iPhone 18 Pro 256GB 的成本将较 2025 年同期新机高出约 38%;2027 年因预估存储器价格维持上行,iPhone 18 Pro 256GB 的成本涨幅可能进一步扩大。
*Wintermute To Trade Commodities, Crypto Etfs, Tokenized Stocks Upon Regulatory APPROVAL: BBG
AggrNews News, *Wintermute to Trade Commodities, Crypto Etfs, Tokenized Stocks Upon Regulatory APPROVAL: BBG
科技记者古尔曼:苹果将跳过M6 Pro/Max芯片 全力押注AI导向的M7系列
火星财经消息,科技记者马克・古尔曼透露,苹果将推出标准版M6芯片,但不会推出定位更高端的M6 Pro和M6 Max芯片。他表示,这一打破以往产品节奏的决定,原因在于AI。苹果原本计划为M7系列带来神经网络处理能力的大幅升级,最终认为这些改进足够重要,因此决定加快下一代产品的推出,而不是完成整个M6产品线。(财联社)