Полный текст статьи представлен на английском; заголовок и аннотация локализованы.
ЧТО ЭТО
Dream Machine is a text-to-video model Luma AI launched in June 2024, usable directly on the web. It accepts text or image input and generates clips of about 5 seconds at 24 frames per second and 1360×768 resolution. On release, its comparatively fast generation and free trial quota drew a large user base. The model does not release its weights.
Почему стоит запомнить
With a low barrier to trial and a direct web entry, it let ordinary users quickly turn text into short video, making it one of the consumer-facing text-to-video options of 2024.
Ключевые характеристики
- Resolution
- 1360×768
- Duration
- About 5 seconds
- Frame rate
- 24 fps
- Input
- Text, image
- Open weights
- No
Возможности
Связанные концепции
Диффузионные модели
Научитесь тысяче мелких шагов удаления шума — и соберёте изображение из чистого шума
Мультимодальная генерация
Одна модель учится говорить, рисовать, двигаться — и даже моделировать трёхмерный мир
Инфраструктура обучения и вывода
Память определяет размер модели, а коммуникации — время обучения; чистая вычислительная мощность редко бывает узким местом
Аналоги
Sora
2024Создаёт связное видео длиной около минуты по текстовому описанию
Gen-3 Alpha
2024Хорошо управляемая модель текст-видео для кино и рекламы
Kling
2024Модель коротких видео как из текста, так и из изображения
Hailuo
2024Модель коротких видео с упором на следование инструкциям и язык камеры
Veo
2024Создаёт видеоклипы 1080p со связными планами
Stable Video Diffusion
2023Превращает один статичный кадр в короткое видео с помощью диффузии