加密货币价格波动剧烈,本站内容仅供参考,不构成投资建议。投资有风险,可能导致全部损失。

查看完整免责声明
返回 7*24 快讯
来源MarsBit

智象发布首款物理规律导向视频模型

火星财经消息,智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型HiDream-O1-Video-1.0(模型简称HD-V1)。HD-V1采用智象自研原生全模态架构,支持文本、图片、视频等多种模态输入,可一键直出5–20秒1080p高保真视频,同时在意图理解、物理规律理解、自主规划叙事、以及音画一体化生成等维度均全面升级。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-07 03:18

智象(HiDream.ai)发布具身世界模型HiDream-O1-Embodied

火星财经消息 9月7日,智象未来(HiDream.ai)正式发布具身世界模型HiDream-O1-Embodied。秉承原生全模态的技术理念,模型强化机器人物理感知与动态预判能力,助力具身智能实现更高阶的物理交互。具身模型的发布,标志着智象逐步实现了打通图像、视频、3D、动作等模态,贯通理解—推演—执行全流程,构建统一世界模型基座的技术闭环。 模型发布同期,HiDream-O1-Embodied首次参评具身智能模型评测平台RoboColiseum,即在核心的Robustness(扰动适应)子榜单中,以平均分0.692的成绩登顶榜首。(广角观察)

08-20 05:06

Meta Muse Video生成视频样片曝光,单次AI最长生成10秒视频

PANews 8月20日消息,据IT之家报道,科技媒体testingcatalog昨日发布博文,报道称Meta公司即将推出Muse Video模型,目前已邀请部分合作伙伴Beta测试,单次可以生成最长10秒视频。根据该媒体测试生成的视频,Muse Video在细节呈现、对场景和物体关系的理解,以及连续画面在时间维度上的稳定性方面,展现出较高潜力。 Meta此前承认模型仍存在音频与画面同步不足的问题,对高速运动的物理准确性也有差距。现有样本为10秒片段,尚不足以验证模型在更长时长叙事、复杂角色持续一致性或高强度动作场景中的稳定表现。

08-17 02:45

智象未来发布交互式世界模型HiDream-O1-World

火星财经消息 8月17日,智象未来(HiDream.ai)正式发布一款原生全模态交互式世界模型HiDream-O1-World,具备漫游、编辑、交互三大功能,支持文本、图像、交互等多模态方式输入,用户可一键生成时空一致、符合物理规律、可长时推演的完整世界。 HiDream-O1-World搭载的是智象自研的原生全模态(UiT)架构,在由美团LongCat团队与复旦大学联合推出的交互式视频世界模型评测基准WBench中,该模型以平均分80.9的成绩登顶核心的Navi分榜榜首,其中在物理(Physical)维度以73.3分位列第一,Consistency(一致性)维度达88.0分。(广角观察)

08-07 13:06

Vitalik:MiniMax H3是首个超越混元Video 1.5的开源视频模型

PANews 8月7日消息,以太坊联合创始人Vitalik Buterin发文表示,MiniMax H3是他见过的首个性能超越腾讯混元HunyuanVideo 1.5的开源视频模型,并称腾讯混元能够长期保持领先本身是一项令人印象深刻的成就。 Vitalik表示,此前图像和视频生成领域的前沿模型相比文本大模型正变得更加封闭,H3则是推动该领域重新走向开放的重要一步。他同时展示了一段由H3生成的视频,称其在自己的AMD笔记本电脑上耗时约30分钟完成。

08-02 08:57

英伟达发布Video Codec SDK 13.1:引入零拷贝转码及精准帧定位能力

Odaily星球日报讯 英伟达官方发布 Video Codec SDK 13.1,为开发者提供多项视频编解码升级,包括 AV1 分层参考模式、零拷贝转码架构、精准帧级搜索、增强硬件解码统计以及全新 Docker 开发环境,进一步提升 AI 视频处理、流媒体和大规模内容分发场景的性能与效率。在解码能力方面,SDK 13.1 新增 H.264/H.265 每宏块级解码统计信息,同时无需额外 CPU 解析开销。 英伟达表示,随着高质量视频流媒体、生成式 AI 视频工具、远程协作和大规模内容分发需求持续增长,Video Codec SDK 13.1 将帮助开发者构建更高效、更低延迟、更易扩展的视频处理管线。

07-31 16:21

英伟达发布Video Codec SDK 13.1:引入零拷贝转码及精准帧定位能力

PANews 8月1日消息,英伟达官方发布 Video Codec SDK 13.1,为开发者提供多项视频编解码升级,包括 AV1 分层参考模式、零拷贝转码架构、精准帧级搜索、增强硬件解码统计以及全新 Docker 开发环境,进一步提升 AI 视频处理、流媒体和大规模内容分发场景的性能与效率。在解码能力方面,SDK 13.1 新增 H.264/H.265 每宏块级解码统计信息,同时无需额外 CPU 解析开销。