这是一款基于 SCAIL-2 + WanAnimatePlus + SAM3 主体追踪 + 多图多角色参考 的 AI 视频生成应用。
用户只需要上传一个驱动视频,再上传主参考图、多张补充参考图和可选背景图,系统就会自动识别驱动视频中的主体动作和人物区域,并把参考图中的角色形象融合到视频中。
和普通图生视频不同,这个流程不是只用一张图生成短片,而是同时结合了驱动视频、多张角色参考图、背景图和主体追踪遮罩。它既能继承原视频的动作、姿态和节奏,又能尽量保持参考人物的身份、服装、外观和角色特征。
工作流内部会自动完成:驱动视频读取、视频尺寸统一、参考图尺寸统一、SAM3 主体追踪、多角色遮罩生成、SCAIL-2 条件融合、WanAnimatePlus 采样生成、视频解码、补帧和最终视频导出。
最终输出的是一段基于驱动视频生成的新视频,适合用于人物替换、动作迁移、多角色参考视频、AI 舞蹈视频、剧情短片、数字人展示、背景替换和多人物创意视频制作。
如果包装成 RunningHub 应用,核心卖点可以直接表达为:
上传驱动视频和多张角色参考图,一键生成多角色一致的 AI 动作视频。