跳到正文
AI 图鉴

Stable Video Diffusion

用扩散模型把一张静态图变成一段短视频

Stability AI 模型 开放权重
输入图像视频

它是什么

Stable Video Diffusion(SVD)是 Stability AI 于 2023 年 11 月发布的图生视频模型,权重开放。它把图像到视频的生成建模为潜空间扩散:以一张静态图为条件,生成一段短视频,并可调节运动幅度。模型在 576×1024 分辨率下默认生成 14 帧。它提供了图像到视频与多视角两类模型,后者可从单图合成绕物体的多视角序列。

为什么值得记住

它是少数把图生视频权重开放出来的模型之一,让「用一张图做短视频」可以在本地或自建服务上运行,推动了图生视频的开源实践。

关键规格

分辨率
576×1024
默认帧数
14 帧
输入
单张图像
权重开放
是

所属能力

相关概念

同类产品