腾讯混元发布并开源语音数字人模型

推荐
快报
广场
科股宝VIP
视频
直播

腾讯混元发布并开源语音数字人模型

2025.05.28 12:32

钛媒体App 5月28日消息，腾讯混元发布并开源语音数字人模型HunyuanVideo-Avatar，支持头肩、半身与全身景别，以及多风格、多物种与双人场景，面向视频创作者提供高一致性、高动态性的视频生成能力。据介绍，用户可上传人物图像与音频，HunyuanVideo-Avatar模型会自动理解图片与音频，比如人物所在环境、音频所蕴含的情感等，让图中人物自然地说话或唱歌，生成包含自然表情、唇形同步及全身动作的视频。

AGI

本文内容仅供参考，不构成投资建议，请谨慎对待。

0 / 300

根据《网络安全法》实名制要求，请绑定手机号后发表评论

请登录后输入评论内容

投资日历