财联社
财经通讯社
打开APP
12:25:50【腾讯发布并开源混元语音数字人模型】
财联社5月28日电,腾讯混元发布并开源的语音数字人模型HunyuanVideo-Avatar,由腾讯混元视频大模型(HunyuanVideo)及腾讯音乐天琴实验室MuseV技术联合研发,支持头肩、半身与全身景别,以及多风格、多物种与双人场景,面向视频创作者提供高一致性、高动态性的视频生成能力。用户可上传人物图像与音频,HunyuanVideo-Avatar模型会自动理解图片与音频,比如人物所在环境、音频所蕴含的情感等,让图中人物自然地说话或唱歌,生成包含自然表情、唇形同步及全身动作的视频。
数字人
财联社声明:文章内容仅供参考,不构成投资建议。投资者据此操作,风险自担。
2025-05-28 12:25:50
2981152 阅读
商务合作
专栏
盘中宝
风口研报
狙击龙虎榜
电报解读
评论
热度
最新
发送