输入图像音频视频
它是什么
SenseAvatar 是商汤科技于 2022 年 8 月推出的数字人视频生成能力,以接口形式提供。它输入一张人像与一段语音,生成口型与语音同步、带自然头部动作的说话数字人视频。它用于虚拟主播、播报与客服等场景。该能力为闭源服务。
为什么值得记住
它把数字人生成简化成「一张照片加一段语音」,让口型同步的虚拟人视频可以按接口批量生产,是数字人走向规模化应用的早期代表。
关键规格
- 输入
- 单张人像与语音
- 输出
- 口型同步的说话数字人视频
- 提供方式
- API
- 开放权重
- 否
它是什么
SenseAvatar 是商汤科技于 2022 年 8 月推出的数字人视频生成能力,以接口形式提供。它输入一张人像与一段语音,生成口型与语音同步、带自然头部动作的说话数字人视频。它用于虚拟主播、播报与客服等场景。该能力为闭源服务。
为什么值得记住
它把数字人生成简化成「一张照片加一段语音」,让口型同步的虚拟人视频可以按接口批量生产,是数字人走向规模化应用的早期代表。