这是一款基于 Wan + InfiniteTalk 的商用级数字人视频应用。
用户上传角色图片和音频后,工作流会先对音频做人声分离与音频编码,再结合角色图、提示词、尺寸控制和多轮采样,生成口型同步、表情自然、连贯度更高的数字人视频。当前文件里可以明确看到它包含 LoadAudio、LoadImage、MelBandRoFormerSampler、AudioEncoderEncode、WanInfiniteTalkToVideo、多组 KSamplerAdvanced、VHS_VideoCombine,并且还有 Character1 Audio and Mask、Character2 Audio and Mask、分辨率、每次处理帧数 等分组,说明这不是简单单阶段口型驱动,而是一套偏商用成片的完整流程。
这条工作流适合:
推荐使用方式:
上传清晰的人物图,人物脸部尽量完整、角度不要太偏;上传清晰的人声音频;提示词尽量描述人物说话时的状态、情绪和镜头氛围,不要写大幅度夸张动作。因为这条流里已经包含了音频分离、音频编码、角色图尺寸适配、分段循环生成和最终音视频合成,所以更适合做“用户只给图和音频,就能直接出数字人成片”的应用。
🎁先领RH币,再去体验工作流!右上角头像→邀请码→输入【rh-v1111】,立领1000RH币,每天登录还能再领100币~更多ComfyUI工作流、教程和玩法,欢迎关注公众号(AIKSK),抖音 / 哔哩哔哩 / 小红书 / YouTube(AI-KSK)同步更新中✨
暂无作品

暂无作品