Stable Video Diffusion
Convierte una imagen fija en un vídeo corto con un modelo de difusión
El texto completo se presenta en inglés; el título y el resumen están traducidos.
QUÉ ES
Stable Video Diffusion (SVD) is an image-to-video model Stability AI released in November 2023 with open weights. It frames image-to-video generation as latent-space diffusion: conditioned on a single still image, it produces a short clip with an adjustable amount of motion. The model generates 14 frames at 576×1024 resolution by default. It shipped as both an image-to-video model and a multi-view model, the latter synthesising views orbiting an object from a single image.
Por qué merece la pena recordarlo
It was one of the few image-to-video models to release open weights, letting “make a short video from one image” run locally or on self-hosted services and advancing open practice in image-to-video.
Especificaciones clave
- Resolution
- 576×1024
- Default frames
- 14 frames
- Input
- Single image
- Open weights
- Yes
Capacidades
Conceptos relacionados
Difusión latente y control condicional
Hacer difusión no sobre píxeles, sino dentro de un espacio semántico comprimido
Modelos de difusión
Aprende mil pequeños pasos de eliminación de ruido y podrás crear una imagen desde ruido puro
Generación multimodal
Un mismo modelo que aprende a hablar, dibujar, moverse e incluso modelar el mundo 3D
Productos similares
Sora
2024Genera vídeo coherente de hasta un minuto a partir de una descripción
Gen-3 Alpha
2024Un modelo texto a vídeo muy controlable para cine y publicidad
Kling
2024Un modelo de vídeo corto para texto a vídeo y imagen a vídeo
Dream Machine
2024Genera vídeos cortos con movimiento a partir de texto o una imagen