概览
Stable Video Diffusion 是 Stability AI 基于 Stable Diffusion 技术构建的生成式视频模型,官方页面标注可生成 14 帧或 25 帧的片段、帧率在 3–30fps 之间可调,出片时间通常不超过 2 分钟,主要以自托管许可(Self-Hosted License)与 Platform API 两种方式交付。Stability AI 的视频线还包括 2025 年 5 月 20 日发布的 Stable Video 4D 2.0(从单段以物体为中心的视频生成动态 4D 资产)与 2025 年 3 月 18 日的 Stable Virtual Camera(把 2D 图像转成有真实景深与透视的 3D 视频,研究预览)。需要说明的是,按 2026 年的行业水平衡量,Stable Video Diffusion 的时长与画质已明显落后于新一代视频模型,其价值更多在于开放权重与可自托管定制。
- 模态
- 视频
能力
- 基于 Stable Diffusion 的生成式视频模型
- 可生成 14 帧或 25 帧片段,帧率 3–30fps 可调
- 单条视频生成通常在 2 分钟以内完成
- 提供自托管许可,可在自有环境部署并深度定制

