输入文本图像视频
它是什么
Kling 是快手于 2024 年 6 月发布的视频生成模型。它同时支持文生视频与图生视频,可生成 5 秒或 10 秒、最高 1080p 的片段,并强调运动幅度与画面稳定性。发布后通过网页产品向用户开放,未公开模型权重。
为什么值得记住
它是较早同时提供文生视频与图生视频并向公众开放的产品之一,凭较大的运动幅度与画面稳定性在 2024 年获得广泛使用。
关键规格
- 分辨率
- 最高 1080p
- 时长
- 5 秒或 10 秒
- 输入
- 文本、图像
- 开放权重
- 否
所属能力
相关概念
同类产品
Sora
2024OpenAI
从一句描述生成最长约一分钟的连贯视频
模型 闭源
文本图像视频
Veo
2024Google DeepMind
生成 1080p、镜头连贯的视频片段
模型 闭源
文本图像视频
Gen-3 Alpha
2024Runway
面向影视与广告的高可控文生视频模型
模型 闭源
文本图像视频
Hailuo
2024MiniMax
主打指令遵循与镜头语言的短视频模型
模型 闭源
文本图像视频
Stable Video Diffusion
2023Stability AI
用扩散模型把一张静态图变成一段短视频
模型 开放权重
图像视频
Dream Machine
2024Luma AI
从文字或图片生成带运动的短视频
模型 闭源
文本图像视频
Seedance
2024ByteDance (Seed)
面向多镜头叙事的视频生成模型
模型 闭源
文本图像视频
SenseAvatar
2022SenseTime
从一张人像与一段语音生成口型同步的数字人视频
API 闭源
图像音频视频