Underdog把Qwen3.8-27B压到7.89GB:工具调用自测超过原版
相关推荐
a16z押注本地 AI 助手Underdog:邮件和日历都留在自己电脑里
动察 Beating AI 快讯,Conway Research 推出个人 AI 助手 Underdog,并获得 a16z、Khosla Ventures 等机构投资。它目前可以直接在 Mac 上运行,连接用户的邮件和日历,帮忙找邮件、整理日程和处理日常事务。模型在本地运行,个人数据不用再交给云端 AI 处理,断网也能继续使用。a16z 已确认领投 Conway Research 首轮融资。 Underdog 能在普通 Mac 上跑起来,一方面是模型已经足够小。当前公开的 Woof 只有 4B 参数,4-bit 权重约 2.37GB。另一方面,团队专门开发了 Husky 推理引擎,针对 Woof 和 Apple Silicon 优化。官方在 M5 Max 上测试,同一套模型在 16 项任务中都快于 MLX,最高达到 4.5 倍。 创始人 Sigil Wen 认为,找邮件、整理文件、处理日程这类日常工作,不需要每次调用数据中心里最强的模型。小模型只要能力够用、速度够快,就可以直接利用用户自己的电脑完成大量任务。 Underdog 接下来还准备进入 iPhone、Windows、Linux、Android 和 NVIDIA 设备。Wen 把这条路线称为「Underdog』s Law」:今天需要数据中心才能运行的前沿 AI,大约半年后就有机会进入个人设备。 团队还在研究让 Agent 直接替用户购物等场景,希望最终把本地 AI 做成长期掌握个人上下文、直接替用户办事的个人 Agent。
PrismML把Qwen3.8 27B压到5.9GB,自测保留98.2%性能
动察 Beating AI 快讯,加州理工学院数学家 Babak Hassibi 联合创立的 AI 实验室 PrismML 发布 Ternary Bonsai 2 27B,把 Qwen3.8 27B 的 270 亿参数模型压到 5.9GB。它把权重压成 -1、0、+1 三种值,体积只有 FP16 原版约九分之一。模型支持 26.2 万 Token 上下文、图文输入和 Agent 工具调用,并以 Apache 2.0 许可开放权重。 相比两个月前的第一代 Bonsai 27B,新版体积基本没变,但底模从 Qwen3.6 换成了 Qwen3.8。PrismML 自测称,综合基准成绩相对完整版的保留率从约 95% 提到 98.2%,其中数学和代码成绩已经非常接近原版。官方还演示了它在 RTX 5090 上直接跑 Cline 编程 Agent 和 Computer Use。
Interfaze把Qwen、Whisper等模型接成一套AI工具箱
动察 Beating AI 快讯,AI 初创公司 Interfaze 开源多模型系统 interfaze-1-lite。它把 OCR、语音识别、图像分割、分类、预测等能力接到同一个接口里。 其中 Qwen3.8-27B 充当调度核心,负责理解用户请求,再调用不同的专用模型干活。比如文档识别会用 Chandra OCR 和 PaddleOCR,语音转文字调用 Whisper,图像分割调用 SAM 2.1,时间序列预测则交给 TimesFM。 开发者本地部署时仍要下载这些模型的权重,Interfaze 省掉的是自己拼装这套系统的工作。它已经处理好模型调度、数据转换和统一输出,对上层应用只暴露一套接口。OCR 等任务还会附带置信度和文字位置,方便后续程序判断是否需要人工复核。 Interfaze 把这种设计称为 Mixture of Architectures。整套系统可以在一张 80GB H100 上运行。
数据:全球中心化交易所 24 小时净流入前三依次为 Gate、Bybit 和 Crypto.com
PANews 10月3日消息,据 DefiLlama 数据,在全球中心化交易所中,Gate 24 小时净流入约 4,603 万美元,排名第一;Bybit 24 小时净流入约 4,438 万美元,排名第二;Crypto.com 约 3,766 万美元,排名第三。
ElevenLabs v4登顶TTS榜,超过Gemini和Qwen
动察 Beating AI 快讯,ElevenLabs 发布新一代语音模型 Eleven v4 和实时版 Eleven v4 Turbo。v4 主打更自然的情绪和声音控制,Turbo 面向实时语音 Agent,中位推理延迟约 100ms。 在 Artificial Analysis 最新 TTS 盲测榜中,Eleven v4 目前以 1315 Elo 排第一。Cartesia Sonic 3.6 为 1275,Gemini 3.8 Flash TTS 为 1267,Qwen-Audio-3.0-TTS-Plus 为 1258。上一代 Eleven v3 目前只有 1169,排第 17。 v3 已经支持笑声、耳语等音频标签,v4 主要把这套控制做得更准。用户可以直接指定语气、节奏、情绪和音效,也可以用自然语言描述一句话该怎么说。模型还把语言覆盖从 70 多种扩到 90 多种,Instant Voice Clone 只需要约 10 秒音频,并增强了长文本和多人对话中的声音一致性。 Turbo 则专门解决实时对话的速度问题。官方文档显示,v3 Conversational 的中位推理延迟约为 280ms,v4 Turbo 降到约 100ms。
数据:全球中心化交易所24小时净流入前三分别为Binance、Bybit与Gate
Odaily星球日报讯 据 DefiLlama 数据,在全球中心化交易所中,24 小时净流入排名前三的平台分别为:Binance(8.09 亿美元)、Bybit(1.96 亿美元)和 Gate(6,094 万美元)。