Stable Video Diffusion
Transforme une image fixe en courte vidéo avec un modèle de diffusion
Le texte intégral est présenté en anglais ; le titre et le résumé sont localisés.
CE QUE C'EST
Stable Video Diffusion (SVD) is an image-to-video model Stability AI released in November 2023 with open weights. It frames image-to-video generation as latent-space diffusion: conditioned on a single still image, it produces a short clip with an adjustable amount of motion. The model generates 14 frames at 576×1024 resolution by default. It shipped as both an image-to-video model and a multi-view model, the latter synthesising views orbiting an object from a single image.
Pourquoi il compte
It was one of the few image-to-video models to release open weights, letting “make a short video from one image” run locally or on self-hosted services and advancing open practice in image-to-video.
Caractéristiques clés
- Resolution
- 576×1024
- Default frames
- 14 frames
- Input
- Single image
- Open weights
- Yes
Capacités
Concepts liés
Diffusion latente et contrôle conditionnel
Diffuser non pas sur les pixels, mais dans un espace sémantique comprimé
Modèles de diffusion
Apprenez mille petits pas de débruitage et vous créerez une image à partir de bruit pur
Génération multimodale
Un seul modèle qui apprend à parler, dessiner, bouger — et même à modéliser le monde 3D
Produits comparables
Sora
2024Génère une vidéo cohérente d’environ une minute à partir d’une description
Gen-3 Alpha
2024Un modèle texte-vidéo très contrôlable pour le cinéma et la publicité
Kling
2024Un modèle de vidéo courte pour texte-vidéo et image-vidéo
Dream Machine
2024Génère de courtes vidéos animées à partir de texte ou d’une image