Stable Video Diffusion
يحوّل صورة ثابتة واحدة إلى فيديو قصير بنموذج انتشار
يُعرض النص الكامل باللغة الإنجليزية؛ وقد تمت ترجمة العنوان والملخص.
ما هو
Stable Video Diffusion (SVD) is an image-to-video model Stability AI released in November 2023 with open weights. It frames image-to-video generation as latent-space diffusion: conditioned on a single still image, it produces a short clip with an adjustable amount of motion. The model generates 14 frames at 576×1024 resolution by default. It shipped as both an image-to-video model and a multi-view model, the latter synthesising views orbiting an object from a single image.
لماذا يستحق التذكّر
It was one of the few image-to-video models to release open weights, letting “make a short video from one image” run locally or on self-hosted services and advancing open practice in image-to-video.
المواصفات الأساسية
- Resolution
- 576×1024
- Default frames
- 14 frames
- Input
- Single image
- Open weights
- Yes
القدرات المرتبطة
المفاهيم ذات الصلة
الانتشار في الفضاء الكامن والتحكم الشرطي
أجرِ الانتشار لا على البكسلات بل داخل فضاء دلالي مضغوط
نماذج الانتشار
تعلّم ألف خطوة صغيرة لإزالة الضوضاء، فتستطيع بناء صورة من ضوضاء صافية
التوليد متعدد الوسائط
نموذج واحد يتعلّم الكلام والرسم والحركة، بل ونمذجة العالم ثلاثي الأبعاد
منتجات منافسة
Sora
2024يولّد فيديو متماسكًا يصل إلى نحو دقيقة من وصف نصي
Gen-3 Alpha
2024نموذج نص إلى فيديو عالي التحكم لأغراض السينما والإعلان
Kling
2024نموذج فيديو قصير يدعم النص إلى فيديو والصورة إلى فيديو
Dream Machine
2024يولّد فيديوهات قصيرة بحركة من نص أو صورة