已加入最后一帧画面,可以分段生成视频了。预设10种音色:0、温柔女主播 1、温柔男播音 2、公孙离 3、刘婵 4、柯南 5、步美 6、哪吒 7、潘金莲 8、紫薇 9、肯德基广告女生
步骤:
1、上传一张图片
2、输入台词。
3、选择配音的音色0-9,选择0可以自定义上传音色克隆
4、参考音频,配音选择0的时候可以上传一段需要被克隆的说话(3S即可无需很长)
5、语速:默认1,可以是1.1 ,1.2,0.9,0.8
6、语气语调说明:语言语气语调,可以不输入,也可以输入简单的 “用中文说”“用英语说”“用上海话温柔的说”“用普通话愤怒的说”“用普通话快速的说”,快乐的说,悲伤的说,愤怒的说,温柔的说,等等。
7、特色高级使用方法:在人物台词中可以输入标点符号控制语调,比如“~”“~~”“~~~”会有不同的语调和停顿感。可以增加[laughter],例如:“我真是觉得好好笑[laughter][laughter][laughter],我实在是有点忍不住了。”,同样的一个[laughter]和3个[laughter]的效果是不一样的哦。用这个可以精细化调整配合图片的配音。
图片采用腾讯sonic,属于目前相当好的数字人。