SadTalkerAI模型使用一张图片与一段音频便可以自动生成视频
SadTalker模型是一个使用图片与音频文件自动合成人物说话动画的开源模型,我们自己给模型一张图片以及一段音频文件,模型会根据音频文件把传递的图片进行人脸的相应动作,比如张嘴,眨眼,移动头部等动作。
SadTalker,它从音频中生成 3DMM 的 3D 运动系数(头部姿势、表情),并隐式调制一种新颖的 3D 感知面部渲染,用于生成说话的头部运动视频。
为了学习真实的运动,SadTalker分别对音频和不同类型的运动系数之间的联系进行显式建模。 准确地说,SadTalker提出 ExpNet模型,通过提取运动系数和3D渲染的面部运动来从音频中学习准确的面部表情。 至于头部姿势,SadTalker通过PoseVAE 以合成不同风格的头部运动。
模型不仅支持英文,还支持中文,我们可以直接hugging face上面来体验
https://huggingface.co/spaces/vinthony/SadTalker
当然官方开源了源代码,我们可以直接在自己电脑上面来运行此模型
https://github.com/OpenTalker/SadTalker
当然我们要运行本程序,需要安装python3.8以上版本,并下载预训练模型,然后新建一个虚拟环境,虚拟环境使用anaconda来建立。
gitclone https://github.com/Winfredy/SadTalker.gitcdSadTalkercondacreate -n sadtalker python=3.8condaactivate sadtalkerpipinstall torch==1.12.1+cu113 torchvision==0.13.1+cu113 torchaudio==0.12.1 --extra-index-url https://download.pytorch.org/whl/cu113condainstall ffmpegpipinstall -r requirements.txttts is optional for gradio demo.pipinstall TTS
然后就可以git sadtalker的工程目录,并安装相应的第三方库,这里主要是torch相关的库,这里为了合成音频的方便,我们同样可以安装TTS来进行音频的合成。
当然下载的预训练模型需要放置在checkpoints目录下,以上所有的操作完成后,我们就可以运行模型了。
pythoninference.py--driven_audio<audio.wav> \--source_image<video.mp4orpicture.png> \--enhancergfpgan
driven_audio是我们需要传递的一段音频文件地址;
source_image可以提供一段视频,或者一张图片;
enhancer 提高生成视频的质量;
以上代码运行完成后,合成的视频保存在results/$SOME_TIMESTAMP/*.mp4。
当然为了保留整个人体图片我们可以在参数中添加still参数,still参数会保留人体图片,并不会进行相应的裁剪。
python inference.py--driven_audio \ --source_image \ --result_dir \--still \--preprocess full \--enhancer gfpgan
若没有这么高的配置,我们也可以使用google colab来进行线上模型的运行。模型不仅可以模仿人类说话,还可以进行唱歌。
-
上一篇
Salesforce推出AICloud服务:集成多个AI模型于一体
站长之家(ChinaZ.com)6月13日消息:
-
下一篇
还在为别人产出的神仙画作而流泪?还在因自己缺乏绘画天赋而叹息?
当当当当!手残党的救星——ai绘画软件它来啦!
不需要专业的绘画技巧也能让你轻松创作出属于自己的艺术作品!
大家可以看看下面几张图片,都是我用ai软件制作的!
只要简单的几步操作,就能自动生成想要的图片~是不是很简单呢?
下面给大家分享三个方法,手把手教你ai绘画二次元词条怎么写,一起来看看吧!
一、使用dreamby wombo软件
1.软件特点:绘画功能全面,一键即可生图,而且它提供了多种艺术风格,让我们能尽情的发挥自己的想象力,创作出富有艺术感的图片。
2.软件介绍:大家是不是觉得我们脑海中天马行空的想法只能在梦境中实现?
不不不,无论是多么不切实际的幻想,只要借助WOMBO Dream这款软件都可以将其具体化的呈现在我们眼前。
不止如此,它还可以将普通的照片转换成各种不同风格的艺术照,每一张都好看到可以当壁纸!
3.使用体验:这款软件使用起来挺简单的,就是输入文字描述的时候需要用英文,有些时候可能要用到一些翻译软件。
4.操作步骤:
(1)在文本框中输入我们想要图片的文字描述,必须是英文描述哦~
(2)选择自己喜欢的艺术风格点击create即可。
二、使用一键AI绘画软件
1.软件特点:功能丰富,这款软件具备了ai绘画、图片格式转换、图片编辑、图片处理、修复工具、特效工具等多个功能,适用于多个场景。
2.软件介绍:朋友们,快看过来!这款软件是我平时用的比较多的,它的ai绘画功能提供了多种不同的风格,而且单次可批量生成多张图片,出图效率很高!
除此以外,还有很多很有趣的功能,例如照片变漫画、修复老照片、性别反转等等。3.使用体验:使用下来我觉得这款软件真的很好用,不仅操作简单,而且相比其他软件它的功能要丰富很多,能满足我们大多的图片处理需求!如果你在找一款多功能的ai绘画软件,不用考虑直接选它就对了!
4.操作步骤:
(1)在画面描述文本框中描述出自己想要的画面;
(2)选择自己喜欢的绘画风格和绘画模型;
(3)点击通用设置,选择需要生成的图片数量,再选择点击生成即可完成操作。
ai绘画生成软件有哪些?下面教你如何输入ai绘画二次元词条