腾讯混元语音数字人模型宣布开源

来源:互联网
2025-06-27 07:05:55

近日,腾讯混元发布并开源语音数字人模型HunyuanVideo-Avatar。


据称,HunyuanVideo-Avatar基于腾讯混元视频大模型(HunyuanVideo)及腾讯音乐天琴实验室MuseV技术联合研发,支持头肩、半身与全身景别,以及多风格、多物种与双人场景,面向视频创作者提供高一致性、高动态性的视频生成能力。


用户可上传人物图像与音频,HunyuanVideo-Avatar 模型会自动理解图片与音频,比如人物所在环境、音频所蕴含的情感等,让图中人物自然地说话或唱歌,生成包含自然表情、唇形同步及全身动作的视频。



目前支持上传不超过14秒的音频进行视频生成,后续将逐步上线和开源其他能力。

其他新闻

  • 超20例,美国外科医生认为Apple Vision Pro在微创手术上具有变革性

  • 《FF15》制作人牵头发布企业元宇宙构建工具“Own World”

  • 2023年黑色星期五英国迎来“有史以来VR收入最高的一周”

联系电话

立即咨询

商务微信