Stable Video Diffusion
Transforma uma imagem estática em um vídeo curto com um modelo de difusão
O texto completo é apresentado em inglês; o título e o resumo estão traduzidos.
O QUE É
Stable Video Diffusion (SVD) is an image-to-video model Stability AI released in November 2023 with open weights. It frames image-to-video generation as latent-space diffusion: conditioned on a single still image, it produces a short clip with an adjustable amount of motion. The model generates 14 frames at 576×1024 resolution by default. It shipped as both an image-to-video model and a multi-view model, the latter synthesising views orbiting an object from a single image.
Por que vale a pena lembrar
It was one of the few image-to-video models to release open weights, letting “make a short video from one image” run locally or on self-hosted services and advancing open practice in image-to-video.
Especificações-chave
- Resolution
- 576×1024
- Default frames
- 14 frames
- Input
- Single image
- Open weights
- Yes
Capacidades
Conceitos relacionados
Difusão latente e controle condicional
Fazer difusão não sobre pixels, mas dentro de um espaço semântico comprimido
Modelos de difusão
Aprenda mil pequenos passos de remoção de ruído e criará uma imagem a partir de ruído puro
Geração multimodal
Um único modelo que aprende a falar, desenhar, mover-se e até modelar o mundo 3D
Produtos semelhantes
Sora
2024Gera vídeo coerente de até cerca de um minuto a partir de uma descrição
Gen-3 Alpha
2024Um modelo texto para vídeo altamente controlável para cinema e publicidade
Kling
2024Um modelo de vídeo curto para texto-vídeo e imagem-vídeo
Dream Machine
2024Gera vídeos curtos com movimento a partir de texto ou de uma imagem