BUNNY H3 Ref2VA 动作迁移
这个 ComfyUI 工作流用于把参考视频中的人物替换为参考图角色,尽量沿用原视频的动作、运镜、切镜和节奏。它支持将参考视频自动转为 24 帧,并以 720P 或 480P 作为输入尺寸,自动识别横竖屏,经过一采和二采输出。
使用方法
1. 将 JSON 导入 ComfyUI,先处理缺失节点和模型文件。
2. 在 BUNNY|参考视频 节点上传原视频。
3. 把目标角色图依次放进参考图分组。图 1 默认启用;使用图 2 或更多图片时,要手动启用相应分组。
4. 在 BUNNY|720P 开 / 480P 关 选择参考视频尺寸:开启为短边 720 像素,关闭为短边 480 像素。横竖屏由原视频自动判断。
5. 针对当前片段写提示词,粘贴到 BUNNY|六段式提示词 节点。附件 Skill 可辅助检查完整视频,并生成六段内容:subject_definitions、summary、retention_analysis、detailed_description、overall_soundscape、non_diegetic_music。
6. 检查提示词中的 <Picture N> 是否与图片输入顺序一致,然后运行,分别检查一采、二采结果。
Skill包后续在B站视频发布。
所需节点
- ComfyUI:原生 H3 参考生成、计算、缩放、采样和分辨率节点。
- ComfyUI-VideoHelperSuite:读取视频、读取视频信息、导出 MP4。
- ComfyUI-KJNodes:Set/Get 节点及 H3 SageAttention 补丁。
- ComfyUI-Easy-Use:easy float 节点。
- MiniMax H3 Latent Upscaler:二采使用的 MinimaxH3LatentUpscaler3D 节点。
- SageAttention:当前启用的 SageAttention 补丁所需;版本须与你的显卡和 ComfyUI 环境兼容。
工作流还保留了原环境中的 忽略多组孤海 分组控制节点。我没查到可核实的公开安装地址。如果导入时缺失,可以移除这些辅助节点,手动管理各参考分组的启用状态。
注意事项
- **720P/480P 是送进 H3 的参考视频尺寸,不是一采输出分辨率。**生成尺寸由输出像素预算和二采设置另行控制。
- 工作流把输入视频转换为 24 帧,并将自动时长向下对齐到 H3 支持的 17n + 5 帧数,因此片尾最多可能少 16 帧。重要的结尾要检查实际生成时长。
- 原视频音轨没有接入 H3 的视频音频参考输入。音乐或原声需要在后期合成。
- 两人快速交叉、互相遮挡时,提示词应按原人物的连续运动轨迹绑定目标角色,并写清换位后的对应关系。输入都正确仍串身份时,可以先换种子测试。
- 模型、人物图片和原视频均需自行提供。这份 JSON 已做结构和连线检查;我没有在另一套全新安装的 ComfyUI 环境中独立验证完整出片。
来源署名
视频不要超过10秒,密集切镜素材(6秒5镜这种)需要分成两段,复杂动作如演示视频的需要使用动作修复LORA来保证旋转翻滚不会出错,skill使用方法:安装skill到你的AI,视频和参考图给它,它就会给你提示词,如果视频出现串人物或者失效问题,首先拷打你的AI!让它睁大眼睛好好看看视频和锚定人物身份词
动作迁移基础节点图改编自 吃猪侠233 分享的原工作流视频。
BUNNY 增加了提示词方法、输入说明、参考视频自动预处理、布局和输出命名。
视频动作迁移_自动横竖屏_720p480p_24fps
BUNNY H3 Ref2VA 动作迁移
这个 ComfyUI 工作流用于把参考视频中的人物替换为参考图角色,尽量沿用原视频的动作、运镜、切镜和节奏。它支持将参考视频自动转为 24 帧,并以 720P 或 480P 作为输入尺寸,自动识别横竖屏,经过一采和二采输出。
使用方法
1. 将 JSON 导入 ComfyUI,先处理缺失节点和模型文件。
2. 在 BUNNY|参考视频 节点上传原视频。
3. 把目标角色图依次放进参考图分组。图 1 默认启用;使用图 2 或更多图片时,要手动启用相应分组。
4. 在 BUNNY|720P 开 / 480P 关 选择参考视频尺寸:开启为短边 720 像素,关闭为短边 480 像素。横竖屏由原视频自动判断。
5. 针对当前片段写提示词,粘贴到 BUNNY|六段式提示词 节点。附件 Skill 可辅助检查完整视频,并生成六段内容:subject_definitions、summary、retention_analysis、detailed_description、overall_soundscape、non_diegetic_music。
6. 检查提示词中的 <Picture N> 是否与图片输入顺序一致,然后运行,分别检查一采、二采结果。
Skill包后续在B站视频发布。
所需节点
- ComfyUI:原生 H3 参考生成、计算、缩放、采样和分辨率节点。
- ComfyUI-VideoHelperSuite:读取视频、读取视频信息、导出 MP4。
- ComfyUI-KJNodes:Set/Get 节点及 H3 SageAttention 补丁。
- ComfyUI-Easy-Use:easy float 节点。
- MiniMax H3 Latent Upscaler:二采使用的 MinimaxH3LatentUpscaler3D 节点。
- SageAttention:当前启用的 SageAttention 补丁所需;版本须与你的显卡和 ComfyUI 环境兼容。
工作流还保留了原环境中的 忽略多组孤海 分组控制节点。我没查到可核实的公开安装地址。如果导入时缺失,可以移除这些辅助节点,手动管理各参考分组的启用状态。
注意事项
- **720P/480P 是送进 H3 的参考视频尺寸,不是一采输出分辨率。**生成尺寸由输出像素预算和二采设置另行控制。
- 工作流把输入视频转换为 24 帧,并将自动时长向下对齐到 H3 支持的 17n + 5 帧数,因此片尾最多可能少 16 帧。重要的结尾要检查实际生成时长。
- 原视频音轨没有接入 H3 的视频音频参考输入。音乐或原声需要在后期合成。
- 两人快速交叉、互相遮挡时,提示词应按原人物的连续运动轨迹绑定目标角色,并写清换位后的对应关系。输入都正确仍串身份时,可以先换种子测试。
- 模型、人物图片和原视频均需自行提供。这份 JSON 已做结构和连线检查;我没有在另一套全新安装的 ComfyUI 环境中独立验证完整出片。
来源署名
视频不要超过10秒,密集切镜素材(6秒5镜这种)需要分成两段,复杂动作如演示视频的需要使用动作修复LORA来保证旋转翻滚不会出错,skill使用方法:安装skill到你的AI,视频和参考图给它,它就会给你提示词,如果视频出现串人物或者失效问题,首先拷打你的AI!让它睁大眼睛好好看看视频和锚定人物身份词
动作迁移基础节点图改编自 吃猪侠233 分享的原工作流视频。
BUNNY 增加了提示词方法、输入说明、参考视频自动预处理、布局和输出命名。
BUNNY H3 Ref2VA 动作迁移
这个 ComfyUI 工作流用于把参考视频中的人物替换为参考图角色,尽量沿用原视频的动作、运镜、切镜和节奏。它支持将参考视频自动转为 24 帧,并以 720P 或 480P 作为输入尺寸,自动识别横竖屏,经过一采和二采输出。
使用方法
1. 将 JSON 导入 ComfyUI,先处理缺失节点和模型文件。
2. 在 BUNNY|参考视频 节点上传原视频。
3. 把目标角色图依次放进参考图分组。图 1 默认启用;使用图 2 或更多图片时,要手动启用相应分组。
4. 在 BUNNY|720P 开 / 480P 关 选择参考视频尺寸:开启为短边 720 像素,关闭为短边 480 像素。横竖屏由原视频自动判断。
5. 针对当前片段写提示词,粘贴到 BUNNY|六段式提示词 节点。附件 Skill 可辅助检查完整视频,并生成六段内容:subject_definitions、summary、retention_analysis、detailed_description、overall_soundscape、non_diegetic_music。
6. 检查提示词中的 <Picture N> 是否与图片输入顺序一致,然后运行,分别检查一采、二采结果。
Skill包后续在B站视频发布。
所需节点
- ComfyUI:原生 H3 参考生成、计算、缩放、采样和分辨率节点。
- ComfyUI-VideoHelperSuite:读取视频、读取视频信息、导出 MP4。
- ComfyUI-KJNodes:Set/Get 节点及 H3 SageAttention 补丁。
- ComfyUI-Easy-Use:easy float 节点。
- MiniMax H3 Latent Upscaler:二采使用的 MinimaxH3LatentUpscaler3D 节点。
- SageAttention:当前启用的 SageAttention 补丁所需;版本须与你的显卡和 ComfyUI 环境兼容。
工作流还保留了原环境中的 忽略多组孤海 分组控制节点。我没查到可核实的公开安装地址。如果导入时缺失,可以移除这些辅助节点,手动管理各参考分组的启用状态。
注意事项
- **720P/480P 是送进 H3 的参考视频尺寸,不是一采输出分辨率。**生成尺寸由输出像素预算和二采设置另行控制。
- 工作流把输入视频转换为 24 帧,并将自动时长向下对齐到 H3 支持的 17n + 5 帧数,因此片尾最多可能少 16 帧。重要的结尾要检查实际生成时长。
- 原视频音轨没有接入 H3 的视频音频参考输入。音乐或原声需要在后期合成。
- 两人快速交叉、互相遮挡时,提示词应按原人物的连续运动轨迹绑定目标角色,并写清换位后的对应关系。输入都正确仍串身份时,可以先换种子测试。
- 模型、人物图片和原视频均需自行提供。这份 JSON 已做结构和连线检查;我没有在另一套全新安装的 ComfyUI 环境中独立验证完整出片。
来源署名
视频不要超过10秒,密集切镜素材(6秒5镜这种)需要分成两段,复杂动作如演示视频的需要使用动作修复LORA来保证旋转翻滚不会出错,skill使用方法:安装skill到你的AI,视频和参考图给它,它就会给你提示词,如果视频出现串人物或者失效问题,首先拷打你的AI!让它睁大眼睛好好看看视频和锚定人物身份词
动作迁移基础节点图改编自 吃猪侠233 分享的原工作流视频。
BUNNY 增加了提示词方法、输入说明、参考视频自动预处理、布局和输出命名。
