输入文本图像视频
它是什么
Gen-3 Alpha 是 Runway 于 2024 年 6 月发布的文生视频模型。它接受文本与图像输入,生成约 5 至 10 秒、720p 的片段,并提供运镜与风格等控制选项。Runway 将其定位在影视与广告等专业创作场景,与其视频编辑工具配套使用。模型未开放权重。
为什么值得记住
它把视频生成明确定位到专业创作流程,强调可控性以及与编辑工具的配合,是 2024 年文生视频走向商用化的一支。
关键规格
- 分辨率
- 720p
- 时长
- 约 5 至 10 秒
- 输入
- 文本、图像
- 开放权重
- 否
所属能力
相关概念
同类产品
Sora
2024OpenAI
从一句描述生成最长约一分钟的连贯视频
模型 闭源
文本图像视频
Kling
2024Kuaishou (Kling)
可文生视频也可图生视频的短视频模型
模型 闭源
文本图像视频
Dream Machine
2024Luma AI
从文字或图片生成带运动的短视频
模型 闭源
文本图像视频
Veo
2024Google DeepMind
生成 1080p、镜头连贯的视频片段
模型 闭源
文本图像视频
Stable Video Diffusion
2023Stability AI
用扩散模型把一张静态图变成一段短视频
模型 开放权重
图像视频
Hailuo
2024MiniMax
主打指令遵循与镜头语言的短视频模型
模型 闭源
文本图像视频