Hallo:用于肖像图像动画的分层音频驱动视觉合成

Hallo,可以根据单张图像和音频输入生成唱歌和说话视频,并能控制人物表情和姿态,和EMO相比,Hallo由于使用了扩散模型来实现层次化的音频驱动视觉合成,它能够通过输入语音,生成对应的人物嘴唇同步、表情变化和姿态变化的动画。提高了语音与生成动画之间的对齐精度,使动画的嘴唇、表情和姿态与语音的同步

Hallo:用于肖像图像动画的分层音频驱动视觉合成.jpg

Hallo功能特征:

  • 虚拟角色动画生成:通过语音音频输入生成逼真的、动态的虚拟角色动画,并实现虚拟角色的口型、表情和姿态的精确同步。

  • 真实角色动画生成:将技术应用于真实人物的语音驱动动画生成,生成的动画能准确反映真实人物的表情和动作变化。

  • 多种运动控制:提供对角色表情、姿态和嘴唇运动的精确控制,支持多种表情和姿态的自适应控制,增强动画的多样性和真实性。

  • 跨演员应用:支持不同身份的个性化动画生成,通过音频输入,生成适应不同角色身份的动画效果。

  • 歌唱动画生成:通过语音和歌曲音频输入,生成同步的歌唱动画,动画能够准确反映歌唱时的口型和表情变化。

Hallo其它特点:

  • 实时性:采用扩散模型结构,增强了动画生成的实时性,使得生成的动画更加逼真和自然。

  • 个性化:可以根据不同的演员或角色定制不同的个性化的动画效果。

  • 多样性:提供多种运动控制,包括表情、姿态和嘴唇运动,使动画更加多样化和真实性。

Hallo项目地址:https://fudan-generative-vision.github.io/hallo

Hallo Github:https://github.com/fudan-generative-vision/hallo

Hallo 论文:https://arxiv.org/abs/2406.08801

HuggingFace:https://huggingface.co/fudan-generative-ai/hallo

收藏

相关文章

最新工具
XiaomiROM
XiaomiROM

一个能下载小米手机、平板等设备官方系统固件的网站,收集了国行、全...

CPS check
CPS check

一人测试用户点击速度(CPS,即每秒点击次数) 的在线网站,可在...

中国庭审公开网
中国庭审公开网

全国法院的庭审直播平台,能看各类案件庭审直播和回放,还能按不同条...

GradientHunt
GradientHunt

一个免费的色彩灵感平台,提供大量手工制作的时尚渐变色,目标是成为...

特工宇宙
特工宇宙

国内首个专注于Agent的科技媒体,由杭州电子科技大学00后毕业...

面灵AI
面灵AI

一款面试辅助工具,能实时分析面试问题并给出专业建议,支持多语言面...

Teleprompter Online
Teleprompter Online

一款免费的在线提词器网页应用,能在PC或Mac的现代网页浏览器上...

Gallerix
Gallerix

也叫“巨人网上博物馆”,是个专注艺术的互联网博物馆,Galler...

快手Kwali
快手Kwali

磁力引擎旗下磁力开创平台推出的AI视频I创作工具,输入自然语言指...

磁力开创
磁力开创

快手磁力引擎推出的一站式视频创意生产平台,结合智能化功能和简化流...