Stable Video Diffusion
Macht aus einem Standbild mit einem Diffusionsmodell ein kurzes Video
Der vollständige Artikel liegt auf Englisch vor; Titel und Zusammenfassung sind lokalisiert.
WAS ES IST
Stable Video Diffusion (SVD) is an image-to-video model Stability AI released in November 2023 with open weights. It frames image-to-video generation as latent-space diffusion: conditioned on a single still image, it produces a short clip with an adjustable amount of motion. The model generates 14 frames at 576×1024 resolution by default. It shipped as both an image-to-video model and a multi-view model, the latter synthesising views orbiting an object from a single image.
Warum es wichtig ist
It was one of the few image-to-video models to release open weights, letting “make a short video from one image” run locally or on self-hosted services and advancing open practice in image-to-video.
Wichtige Eckdaten
- Resolution
- 576×1024
- Default frames
- 14 frames
- Input
- Single image
- Open weights
- Yes
Fähigkeiten
Verwandte Konzepte
Latente Diffusion und konditionale Steuerung
Diffusion nicht über Pixel, sondern in einem komprimierten semantischen Raum
Diffusionsmodelle
Lerne tausend kleine Entrauschungsschritte, und du erzeugst ein Bild aus reinem Rauschen
Multimodale Generierung
Ein Modell, das sprechen, zeichnen, sich bewegen — und sogar die 3D-Welt modellieren lernt
Vergleichbare Produkte
Sora
2024Erzeugt aus einer Beschreibung kohärentes Video von bis zu etwa einer Minute
Gen-3 Alpha
2024Ein gut steuerbares Text-zu-Video-Modell für Film und Werbung
Kling
2024Ein Kurzvideo-Modell für Text-zu-Video und Bild-zu-Video
Dream Machine
2024Erzeugt kurze Videos mit Bewegung aus Text oder einem Bild