Stable Video Diffusion
Biến một ảnh tĩnh thành video ngắn bằng mô hình khuếch tán
Toàn văn của trang này được trình bày bằng tiếng Anh; tiêu đề và phần dẫn đã được bản địa hóa.
NÓ LÀ GÌ
Stable Video Diffusion (SVD) is an image-to-video model Stability AI released in November 2023 with open weights. It frames image-to-video generation as latent-space diffusion: conditioned on a single still image, it produces a short clip with an adjustable amount of motion. The model generates 14 frames at 576×1024 resolution by default. It shipped as both an image-to-video model and a multi-view model, the latter synthesising views orbiting an object from a single image.
Vì sao đáng ghi nhớ
It was one of the few image-to-video models to release open weights, letting “make a short video from one image” run locally or on self-hosted services and advancing open practice in image-to-video.
Thông số chính
- Resolution
- 576×1024
- Default frames
- 14 frames
- Input
- Single image
- Open weights
- Yes
Năng lực liên quan
Khái niệm liên quan
Khuếch tán trong không gian ẩn và điều khiển có điều kiện
Khuếch tán không trên điểm ảnh, mà trong một không gian ngữ nghĩa đã nén
Mô hình khuếch tán
Học ngàn bước khử nhiễu nhỏ, bạn tạo được ảnh từ nhiễu thuần
Sinh đa phương thức
Một mô hình học nói, vẽ, chuyển động — thậm chí mô hình hóa thế giới ba chiều
Sản phẩm cùng loại
Sora
2024Tạo video mạch lạc dài tới khoảng một phút từ một mô tả
Gen-3 Alpha
2024Mô hình văn bản thành video dễ điều khiển cho phim và quảng cáo
Kling
2024Mô hình video ngắn cho cả văn bản thành video và ảnh thành video
Dream Machine
2024Tạo video ngắn có chuyển động từ văn bản hoặc ảnh