Toàn văn của trang này được trình bày bằng tiếng Anh; tiêu đề và phần dẫn đã được bản địa hóa.
NÓ LÀ GÌ
Sora is a text-to-video model OpenAI first unveiled in February 2024. It tokenises video into spacetime patches and performs diffusion-style generation over that unified representation, which lets it accept different resolutions and durations. It accepts both text and image input for text-to-video and image-to-video. In its first demonstrations, clips ran up to about 60 seconds at 1080p, making it one of the few models to show minute-scale coherent video at the time.
Vì sao đáng ghi nhớ
It brought minute-scale, shot-coherent video generation into public view for the first time, moving video generation beyond short clips toward consistency over longer stretches.
Thông số chính
- Resolution
- Up to 1080p (first disclosure)
- Duration
- Up to about 60 seconds (first disclosure)
- Input
- Text, image
- Open weights
- No
Năng lực liên quan
Khái niệm liên quan
Mô hình khuếch tán
Học ngàn bước khử nhiễu nhỏ, bạn tạo được ảnh từ nhiễu thuần
Sinh đa phương thức
Một mô hình học nói, vẽ, chuyển động — thậm chí mô hình hóa thế giới ba chiều
Hạ tầng huấn luyện và suy luận
Bộ nhớ quyết định mô hình lớn đến đâu, còn truyền thông quyết định mất bao lâu
Sản phẩm cùng loại
Veo
2024Tạo clip video 1080p với các cảnh mạch lạc
Gen-3 Alpha
2024Mô hình văn bản thành video dễ điều khiển cho phim và quảng cáo
Kling
2024Mô hình video ngắn cho cả văn bản thành video và ảnh thành video
Hailuo
2024Mô hình video ngắn chú trọng tuân thủ chỉ dẫn và ngôn ngữ máy quay
Stable Video Diffusion
2023Biến một ảnh tĩnh thành video ngắn bằng mô hình khuếch tán
Dream Machine
2024Tạo video ngắn có chuyển động từ văn bản hoặc ảnh
Seedance
2024Mô hình tạo video hướng tới kể chuyện nhiều cảnh
Synthesia
2019Nhập văn bản, nhận video có nhân vật ảo đang nói