腾讯混元发布并开源语音数字人模型

鞭牛士 2025-05-28 13:03

5月28日，腾讯混元发布并开源语音数字人模型HunyuanVideo-Avatar，支持头肩、半身与全身景别，以及多风格、多物种与双人场景。

据介绍，用户可上传人物图像与音频，HunyuanVideo-Avatar模型会自动理解图片与音频，比如人物所在环境、音频所蕴含的情感等，让图中人物自然地说话或唱歌，生成包含自然表情、唇形同步及全身动作的视频。

扫码下载app 最新资讯实时掌握