输入图像视频
它是什么
Stable Video Diffusion(SVD)是 Stability AI 于 2023 年 11 月发布的图生视频模型,权重开放。它把图像到视频的生成建模为潜空间扩散:以一张静态图为条件,生成一段短视频,并可调节运动幅度。模型在 576×1024 分辨率下默认生成 14 帧。它提供了图像到视频与多视角两类模型,后者可从单图合成绕物体的多视角序列。
为什么值得记住
它是少数把图生视频权重开放出来的模型之一,让「用一张图做短视频」可以在本地或自建服务上运行,推动了图生视频的开源实践。
关键规格
- 分辨率
- 576×1024
- 默认帧数
- 14 帧
- 输入
- 单张图像
- 权重开放
- 是