跳到正文
AI 图鉴

Veo

生成 1080p、镜头连贯的视频片段

Google DeepMind 模型 闭源
输入文本图像视频

它是什么

Veo 是 Google DeepMind 于 2024 年 5 月公布的文生视频模型。它接受文本或图像输入,可生成 1080p、片长超过一分钟的视频,并支持多种电影化的镜头风格与运镜控制。Veo 同时用于 YouTube 的短视频工具等产品场景。它没有开放权重。

为什么值得记住

它把高分辨率、较长时长与可控运镜放进同一个视频模型,并直接接入 Google 的产品线,是 2024 年文生视频竞争中的重要一支。

关键规格

分辨率
1080p
时长
超过 60 秒(首次公布)
输入
文本、图像
开放权重
否

所属能力

相关概念

同类产品