概览
HunyuanVideo-1.5 是腾讯混元于 2025 年 11 月 20 日开源的视频生成模型,参数量 83 亿,架构为 DiT + 3D 因果 VAE(空间 16 倍、时间 4 倍压缩),并引入「选择性滑动块注意力(SSTA)」提升长视频效率,官方数据是 10 秒 720p 合成提速 1.87 倍。默认生成 121 帧、24fps(约 5 秒),支持 16:9 等多种比例,可通过超分模块输出 1080p。相比 2024 年 12 月发布的初代 HunyuanVideo(130 亿参数、当时最大的开源视频模型,人工评测中文本对齐 61.8%、运动质量 66.5%、画面质量 95.7%、综合排名第一),1.5 版本用不到三分之二的参数换来了消费级显卡(最低约 14GB 显存)可跑的部署门槛。
- 模态
- 视频
- 参数量
- 8.3B
能力
- 文生视频(T2V)与图生视频(I2V)
- 原生 480p / 720p 生成,并可超分到 1080p
- 中英双语理解,采用字形感知的文本编码
- SSTA 稀疏滑动块注意力,10 秒 720p 合成提速 1.87 倍
- 消费级显卡可跑,开启显存卸载后最低约 14GB 显存

