返回 7*24 快讯
来源PANews

小米发布并开源Xiaomi-CocktailASR-1

PANews 9月11日消息,小米正式发布并开源工业级目标说话人语音识别大模型Xiaomi-CocktailASR-1。据介绍,Xiaomi-CocktailASR-1旨在解决“鸡尾酒会”难题。该模型采用端到端LLM架构,以目标说话人的一段参考音频作为声纹提示,可在多人同时说话的复杂环境中,精准提取并仅转录目标用户的语音。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

07-16 03:59

小米发布机器人基座模型Xiaomi-Robotics-1

PANews 7月16日消息,据金十报道,小米集团(01810.HK)机器人事业部发布Xiaomi-Robotics-1,一个面向真实移动操作任务的具身基座模型。模型基于10万小时真实世界数据进行预训练,并结合跨本体数据完成后训练。完成后训练后,Xiaomi-Robotics-1即可在真实环境中,根据自然语言指令直接执行多类移动操作任务。

09-05 02:28

小米发布通用表格数据基础大模型Xiaomi-TabLDM

动察 Beating AI 快讯,小米今日正式发布 Xiaomi-TabLDM,即通用表格数据基础大模型。 据介绍,Xiaomi-TabLDM 采用单一预训练模型及统一默认配置,可直接适配不同表格数据集,无需针对每项任务重新训练、调参或进行后置集成,即可完成分类与回归预测。 小米表示,该模型旨在降低表格数据建模的使用门槛,为不同场景下的结构化数据分析与预测提供通用基础能力。

08-11 12:15

PANews主题Space「AI投资"半场休息":下半场买什么?从算力卖铲人到AI应用者」直播中

PANews 8月11日消息,PANews 今晚20时举办「AI投资"半场休息":下半场买什么?从算力卖铲人到AI应用者」主题Space活动,由PANews Jae主持,对话投资TALK君、BIT经纪业务负责人Elio Cui、Virtuals生态负责人Harry及The Mu联合创始人Sun,围绕AI资本开支可持续性、AI应用端落地逻辑、算力硬件主线是否走完、HALO资产重估、中国数字基础设施机会等话题展开深度讨论。 Space直播地址: https://twitter.com/i/spaces/1dKrPrEgyOlJX

08-10 00:27重要

朝鲜黑客组织构建本地LLM环境,AI攻击能力全面升级

BlockBeats 消息,8 月 10 日,网络安全企业 Genians 于 8 月 10 日披露,朝鲜侦察总局下属黑客组织金速基(Kimsuky)已在生成型 AI 应用上实现重大升级——不仅将 AI 用于钓鱼诱饵制作,更进一步构建了独立运行的本地大型语言模型(LLM)环境及检索增强生成(RAG)体系,具体工具涵盖 Ollama、GPT4All、Msty 等本地 LLM 管理工具及 AI 代码编辑器 Cursor,意图实现情报提取与攻击流程自动化。(韩联社)

07-20 10:58

Vitalik:无法确定 LLM 是否能覆盖全部人类能力,支持 AI 适度减速

Foresight News 消息,Vitalik Buterin 在 Farcaster 发文,系统阐述了其对 AI 能力增长的判断框架。他将人类历史上的机器进步分为三波:工业革命带来的大规模制造能力、计算机带来的可以用精确逻辑规则定义的脑力任务,以及大语言模型(LLM)带来的可通过海量样本定义的任务能力。他认为当前最关键的问题在于,LLM 加上后续改进是否能最终覆盖所有人类能力,这一点目前无法确定。他将 AGI 定义为「若上传至机器人体内、人类突然消失后仍能独立延续文明的 AI」,并认为一旦达到这一节点,人类作为地球主宰将只是历史偶然,而非根本性优势。 Vitalik 表示,其理想的未来是:全球政治与经济多元格局得以保留、人类与机器深度融合而非被取代,以及为不愿改变生活方式的人保留可选择的空间。他同时警告,这条通向理想未来的路极为狭窄,可能被多种风险打断。包括 AI 自主性过强、单一国家或企业取得决定性优势并将其锁定,以及人机融合本身未能保留足够的人类本质。他表示支持 AI 减速或暂停提案,希望以较慢的速度穿越这段高风险时期,并认为若开源模型权重能够抑制前沿模型的资本投入,将是无需强硬政治手段即可实现减速的理想路径。

07-15 07:43

小米开源380亿参数模型Xiaomi-Robotics-U0

火星财经消息,小米正式发布Xiaomi-Robotics-U0——一个拥有380亿参数的多模态自回归具身生成基础模型。据介绍,它既能在保持几何一致性的前提下,对已有数据做增强——换物体、换光照、换背景、加干扰,无需重新采集;也能从零生成全新场景,覆盖危险、极端、长尾等真机难以触达的环境。(财联社)