跳到正文
AI 图鉴

SenseAvatar

从一张人像与一段语音生成口型同步的数字人视频

SenseTime API 闭源
输入图像音频视频

它是什么

SenseAvatar 是商汤科技于 2022 年 8 月推出的数字人视频生成能力,以接口形式提供。它输入一张人像与一段语音,生成口型与语音同步、带自然头部动作的说话数字人视频。它用于虚拟主播、播报与客服等场景。该能力为闭源服务。

为什么值得记住

它把数字人生成简化成「一张照片加一段语音」,让口型同步的虚拟人视频可以按接口批量生产,是数字人走向规模化应用的早期代表。

关键规格

输入
单张人像与语音
输出
口型同步的说话数字人视频
提供方式
API
开放权重
否

所属能力

相关概念

同类产品