最新资讯腾讯混元语音数字人模型宣布开源

2025-05-29 / vrtuoluo / 0浏览

近日，腾讯混元发布并开源语音数字人模型HunyuanVideo-Avatar。

据称，HunyuanVideo-Avatar基于腾讯混元视频大模型（HunyuanVideo）及腾讯音乐天琴实验室MuseV技术联合研发，支持头肩、半身与全身景别，以及多风格、多物种与双人场景，面向视频创作者提供高一致性、高动态性的视频生成能力。

用户可上传人物图像与音频，HunyuanVideo-Avatar 模型会自动理解图片与音频，比如人物所在环境、音频所蕴含的情感等，让图中人物自然地说话或唱歌，生成包含自然表情、唇形同步及全身动作的视频。

目前支持上传不超过14秒的音频进行视频生成，后续将逐步上线和开源其他能力。

投稿/爆料：tougao@youxituoluo.com

稿件/商务合作：六六（微信 13138755620）

加入行业交流群：六六（微信 13138755620）

版权申明：本文经原作者授权发布，不代表VR陀螺立场，如需转载请直接联系原作者