मुख्य सामग्री पर जाएँ

Veo

सुसंगत शॉट के साथ 1080p वीडियो क्लिप बनाता है

Google DeepMind मॉडल बंद स्रोत
इनपुटटेक्स्टइमेजवीडियो

यह पृष्ठ अंग्रेज़ी में प्रस्तुत है; शीर्षक और सारांश का स्थानीयकरण किया गया है।

यह क्या है

Veo is a text-to-video model Google DeepMind announced in May 2024. It accepts text or image input, generates 1080p video longer than a minute, and supports several cinematic styles and camera controls. Veo is also used in product settings such as YouTube’s short-form tools. Its weights are not open.

यह क्यों महत्वपूर्ण है

It put high resolution, longer duration and controllable camera work into a single video model and fed it directly into Google’s product line, making it a major entry in the 2024 text-to-video race.

मुख्य विशिष्टताएँ

Resolution
1080p
Duration
Over 60 seconds (first disclosure)
Input
Text, image
Open weights
No

संबंधित क्षमताएँ

संबंधित अवधारणाएँ

समान उत्पाद

Sora

2024
OpenAI

एक विवरण से लगभग एक मिनट तक का सुसंगत वीडियो बनाता है

मॉडल बंद स्रोत
टेक्स्टइमेजवीडियो

Gen-3 Alpha

2024
Runway

फ़िल्म और विज्ञापन के लिए अत्यधिक नियंत्रण योग्य टेक्स्ट-टू-वीडियो मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजवीडियो

Kling

2024
Kuaishou (Kling)

टेक्स्ट-टू-वीडियो और इमेज-टू-वीडियो दोनों के लिए शॉर्ट-वीडियो मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजवीडियो

Dream Machine

2024
Luma AI

पाठ या चित्र से गति युक्त छोटे वीडियो बनाता है

मॉडल बंद स्रोत
टेक्स्टइमेजवीडियो

Seedance

2024
ByteDance (Seed)

मल्टी-शॉट कथा-कथन के लिए वीडियो जनरेटिंग मॉडल

मॉडल बंद स्रोत
टेक्स्टइमेजवीडियो

Synthesia

2019
Synthesia

टेक्स्ट लिखें, बोलते अवतार वाला वीडियो पाएँ

ऐप बंद स्रोत
टेक्स्टवीडियो