HunyuanVideo

我们提出了 HunyuanVideo,这是一种新颖的开源视频基础模型,它在视频生成方面表现出可与领先的闭源模型相当甚至优越的性能。为了训练 HunyuanVideo 模型,我们采用了多项关键技术进行模型学习,包括数据管理、图像-视频联合模型训练以及旨在促进大规模模型训练和推理的高效基础设施。此外,通过有效的模型架构和数据集扩展策略,我们成功训练了一个拥有超过 130 亿个参数的视频生成模型,使其成为所有开源模型中最大的模型。 我们进行了广泛的实验并实施了一系列有针对性的设计,以确保高视觉质量、运动多样性、文本-视频对齐和生成稳定性。根据专业的人工测评结果,混元视频的表现优于之前最先进的模型,包括Runway Gen-3、Luma 1.6和3个性能最好的中国视频生成模型。通过发布基础模型及其应用的代码和权重,我们旨在弥合闭源和开源视频基础模型之间的差距。这一举措将使社区中的每个人都能够尝试自己的想法,从而培育一个更具活力和活力的视频生成生态系统。
文生视频
立即创建
支持自启动
0GB
0
推荐显存: 80G
上传时间:2025/08/21
模型创建
使用说明
本地部署
讨论

暂无文档

新人好礼
客服中心