PrismML把Qwen3.6压到4GB,27B模型塞进iPhone
相关推荐
PrismML发布Bonsai 27B,270亿参数AI模型首次适配iPhone
PANews 7月16日消息,据Decrypt报道,PrismML发布Bonsai 27B模型,这是首个能够在消费级智能手机上运行的270亿参数AI模型。该模型被压缩至3.9GB,可在iPhone 17 Pro Max上以每秒11个token的速度运行。三进制变体压缩至5.9GB,在M5 Pro笔记本上达到每秒26个token。压缩技术基于加州理工学院知识产权,将每个模型权重从16位浮点精度降至仅正1或负1,二进制变体比全精度模型小14倍。在15项基准测试中,三进制Bonsai 27B平均得分80.49,达到全精度模型94.6%的性能。该模型以Apache 2.0许可证免费发布。
机构:预估iPhone 18 Pro成本大增近40%,苹果或调整毛利策略以稳健出货
火星财经消息,8 月 10 日,根据 TrendForce 集邦咨询最新手机产业研究,由于以存储器为首的零部件价格上涨,推升 Apple(苹果)将发布的 iPhone 18 系列整机成本。 TrendForce 集邦咨询预估第三季 iPhone 18 Pro 256GB 的成本将较 2025 年同期新机高出约 38%;2027 年因预估存储器价格维持上行,iPhone 18 Pro 256GB 的成本涨幅可能进一步扩大。
苹果洽谈AI公司PrismML 拟将270亿参数大模型部署至iPhone
火星财经消息,人工智能公司PrismML宣布,已成功将一个拥有270亿参数的AI模型进行压缩,使其能够在iPhone上流畅运行。另据悉,苹果公司已与PrismML展开接洽,探讨其技术的潜在应用场景。(财联社)
苹果Vision Pro兼智能眼镜主管Paul Meade将加盟OpenAI
据动察 Beating 监测,知情人士透露,苹果公司负责 Vision Pro 头显及智能眼镜硬件工程的副总裁 Paul Meade 将于下周离职,随后加入 OpenAI 硬件部门,负责研发未来的一系列 AI 硬件设备。Meade 在苹果工作了 16 年,曾是 iPad 和 iPhone 项目的核心工程管理负责人,于 2017 年加入负责头显研发的视觉产品集团(Vision Products Group,简称 VPG),并自 2019 年起全面主管硬件工程。 随着 Vision Pro 销售表现低迷,苹果近期大幅调整了硬件路线图,将研发重心从封闭式头显转向类似 Meta 的智能眼镜。曾任 VPG 负责人的 Mike Rockwell 已调往 Siri 团队,导致 VPG 被拆分为独立的硬件和软件组织。Meade 离职的另一大背景是苹果硬件工程部门近期的大规模重组。在 John Ternus 确定于 9 月 1 日接替 Tim Cook 出任首席执行官后,新任首席硬件官 Johny Srouji 启动了重组,使得 Meade 在内的多位副总裁汇报层级被推至新任副总裁 Tom Marieb 之下,实际上降了一级。 Meade 加入 OpenAI 后,将与 Jony Ive、Tang Tan 及 Evans Hankey 等苹果前设计高管再度共事。三名高管创办的 AI 硬件初创公司已于去年被 OpenAI 以 65 亿美元收购。目前,苹果与 OpenAI 的发言人均拒绝发表评论。
苹果AI大重构内幕:Vision Pro负责人罗克韦尔跨界救火,铁腕清洗Siri团队
据动察 Beating 监测,2025 年初,苹果软件工程部旁的会议室里,一场没有 CEO 蒂姆·库克(Tim Cook)出席的高管闭门会议紧急召开。由于首代 Apple Intelligence 市场反响惨淡,Siri 的关键重构面临延期,且谷歌、OpenAI 等对手正全速狂奔,高管埃迪·库伊(Eddy Cue)甚至在内部警告「AI 十年内可能颠覆 iPhone 业务」。当时库克已对时任 AI 负责人约翰·詹南德雷亚(John Giannandrea)失去信心,其余高管决定越过负责人直接商讨方案,向库克递交建议。会议不仅促使库克打破长期的「甩手掌柜」风格、开始亲自深度介入并微调 AI 开发细节,更开启了苹果 AI 业务的全面自救与重组。 会议中,刚主持开发完 Vision Pro 的迈克·罗克韦尔(Mike Rockwell)站了出来,主动请缨担任 「AI 救火队员」。罗克韦尔希望直接向库克汇报并晋升高级副总裁,软件主管克雷格·费德里吉(Craig Federighi)则坚决捍卫软件工程部的控制权,坚持 AI 业务不能脱离本部门。虽然罗克韦尔因认为费德里吉缺乏紧迫感一度想要退缩,但最终接受妥协,出任向费德里吉汇报的 Siri 负责人。上任后,罗克韦尔迅速清洗了 Siri 原有领导层,引入 Vision Pro 核心骨干,并在技术路线上面对现实:意识到自研模型落后于行业水平,罗克韦尔联合费德里吉、库伊与竞争对手谷歌达成协议,直接使用谷歌 Gemini 模型和谷歌云技术支撑新 Siri 运行。 引入外部模型的自救方案将在 WWDC 2026 迎来首秀。苹果将发布对标 ChatGPT 的独立 Siri 应用以及生成式照片编辑功能,彻底推翻了高管层此前排斥聊天机器人和生成式修图的态度。WWDC 2026 也是库克在 9 月 1 日正式卸任、交棒给新 CEO 约翰·特纳斯(John Ternus)前的收官一役。新 Siri 的成败不仅影响库克职业生涯的评判,也直接关系到特纳斯时代的前途。受制于底层 AI 技术瓶颈,桌面机器人(延至 2028 年)、智能屏幕(延至 2026 年底)和 AI 眼镜(延至 2027 年底)等硬件已全线被迫延期,重构成果将决定苹果能否夺回下一代计算时代的主导权。
AMD宣布为阿里千问模型Qwen3.8 27B提供“Day 0”支持
Odaily星球日报讯 AMD 宣布为阿里通义千问(Qwen)最新一代模型 Qwen3.8 27B 提供“Day 0”支持,开发者可在模型发布当天即可通过 AMD 硬件本地运行该大规模开源 AI 模型。 AMD 表示,Qwen3.8 27B 是一款适合本地 AI 开发的 27B 参数密集型模型,延续 Qwen 系列在代码生成、实际工作任务、科研以及长上下文 AI 应用方面的优化方向。该模型可通过开源推理框架 llama.cpp 运行于搭载 AMD 处理器的 AI PC 和工作站,或单张 AMD 32GB 显卡上,同时支持具备超过 24GB 可变显存(VGM)或显存容量的 AMD 硬件平台。 AMD 初步测试显示,Qwen3.8 27B 在 AMD 平台上具备较高本地推理性能:在 AMD Ryzen AI Max+ 395 处理器上,最高可达到 24.5 tokens/秒;在单张 Radeon AI PRO R9700 GPU 上,最高可达到 51.8 tokens/秒。测试基于 Windows 系统、llama.cpp Vulkan 后端,并启用多令牌预测(MTP)优化。AMD 表示,随着后续软件和模型优化推进,实际性能仍有提升空间。