本申请实施例涉及视频处理,具体涉及一种视频处理方法、系统、电子设备及计算机可读存储介质。
背景技术:
1、为了满足不同背景需要,在制作如教学、产品介绍等视频时,会采用真人绿幕录制方式。真人绿幕录制方式是人物在绿幕前出镜拍摄成绿幕视频后,先采用色键抠图算法抠出绿幕视频中的人物,再将抠像后人物和其他背景结合形成视频,以将绿幕视频的绿幕区域替换为其他背景。
2、但是,真人绿幕录制方式对真人拍摄要求较高,一旦出错需要重新拍摄,因此,通过绿幕录制方式制作视频,对真人拍摄的容错率较低。
技术实现思路
1、本申请实施例提供一种视频处理方法、系统、电子设备及计算机可读存储介质,能够提高采用绿幕录制方式制作视频时对真人拍摄的容错率。
2、第一方面,本申请实施例提供一种视频处理方法,应用于投屏发送端,所述方法包括:
3、基于目标发音对象的待处理绿幕视频进行绿幕抠像处理,得到所述目标发音对象的抠像视频;
4、确定所述抠像视频中的待替换视频片段;
5、基于所述待替换视频片段的第一音频,生成所述待替换视频片段的目标数字人视频;
6、基于所述目标数字人视频和所述抠像视频进行合成处理,得到所述目标发音对象的合成视频。
7、第二方面,本申请还提供一种视频处理系统,所述视频处理系统包括:
8、音视频采集模块,用于采集目标发音对象的待处理绿幕视频;
9、绿幕抠像处理模块,用于基于目标发音对象的待处理绿幕视频进行绿幕抠像处理,得到所述目标发音对象的抠像视频;
10、视频合成模块,用于确定所述抠像视频中的待替换视频片段;
11、数字人渲染模块,用于基于所述待替换视频片段的第一音频,生成所述待替换视频片段的目标数字人视频;
12、所述视频合成模块,还用于基于所述目标数字人视频和所述抠像视频进行合成处理,得到所述目标发音对象的合成视频。
13、第三方面,本申请实施例还提供一种电子设备,所述电子设备包括处理器和存储器,所述存储器中存储有计算机程序,所述处理器调用所述存储器中的计算机程序时执行本申请实施例提供的任一种视频处理方法。
14、第四方面,本申请实施例还提供一种计算机可读存储介质,其上存储有计算机程序,所述计算机程序被处理器进行加载,以执行所述的视频处理方法。
15、从以上内容可得出,本申请实施例具有以下的有益效果:
16、本申请实施例通过先基于抠像视频中的待替换视频片段的第一音频,生成所述待替换视频片段的目标数字人视频;再将目标数字人视频和所述抠像视频进行合成处理,得到所述目标发音对象的合成视频;一方面,可以生成目标数字人视频用于替换待替换视频片段,因此可以允许待处理绿幕视频存在拍摄错误;由此,可以提高采用绿幕录制方式制作视频时对真人拍摄的容错率;另一方面,由于是基于待替换视频片段的第一音频生成目标数字人视频,因此可以使得所生成的目标数字人视频与目标发音对象的实际形象更贴合,提高替换后视频的自然度和协调性,使得合成视频更加自然和协调。
1.一种视频处理方法,其特征在于,所述方法包括:
2.根据权利要求1所述的视频处理方法,其特征在于,所述基于所述待替换视频片段的第一音频,生成所述待替换视频片段的目标数字人视频,包括:
3.根据权利要求2所述的视频处理方法,其特征在于,所述目标数字人模型通过如下步骤得到:
4.根据权利要求2所述的视频处理方法,其特征在于,所述获取所述目标发音对象的目标数字人模型,包括:
5.根据权利要求2所述的视频处理方法,其特征在于,所述方法还包括:
6.根据权利要求5所述的视频处理方法,其特征在于,所述目标数字人模型包含第二样本文字的动作特征组,所述第二样本文字的动作特征组是所述目标发音对象在第二样本文字的第三动作轮廓图、以及与所述第三动作轮廓图关联的第三音频特性;
7.根据权利要求2所述的视频处理方法,其特征在于,所述目标数字人模型中包含所述阐述文字的至少两个动作特征组,所述阐述文字的动作特征组是所述目标发音对象在所述阐述文字的第五动作轮廓图、以及与所述第五动作轮廓图关联的第五音频特性;
8.根据权利要求1所述的视频处理方法,其特征在于,所述基于所述待替换视频片段的第一音频,生成所述待替换视频片段的目标数字人视频,包括:
9.根据权利要求1所述的视频处理方法,其特征在于,所述基于所述目标数字人视频和所述抠像视频进行合成处理,得到所述目标发音对象的合成视频,包括:
10.一种视频处理系统,其特征在于,所述视频处理系统包括:
11.一种电子设备,其特征在于,包括存储器,处理器及存储在存储器上并可在处理器上运行的计算机程序,其中,所述处理器执行所述程序时实现如权利要求1-9任一项所述的视频处理方法。
12.一种计算机可读存储介质,其特征在于,其上存储有计算机程序,其中,所述计算机程序被处理器执行时实现如权利要求1-9任一项所述方法。
