本工作流是基于 MiniMax-H3(FL2VA) 底模深度定制的专业武打动作视频生成工作流,搭配全新迭代的 Wushu Action LoRA V7 模型,采用双引擎采集训练方案,分别通过 musubi-tuner、AI-Toolkit 双框架独立训练,形成双版本模型素材,实现高质量、高还原度的中式武术打斗视频AI生成,是适配ComfyUI的即插即用影视级武打动画工作流。
针对传统AI武打视频动作僵硬、招式杂乱、画面模糊、动作不连贯等痛点,本工作流完成全方位优化升级。训练数据集精选 924段专业武打片段,摒弃模糊泛化标注,采用武术专业招式术语精细化打标,解决了旧版本标注不专业、片段切割细碎、动作失真的核心问题。同时适配FL2VA分区底模特性,规避了PRUNED量化底模的适配缺陷,大幅提升武打动作的规范性、连贯性与真实感。
工作流架构极简高效,适配全套MiniMax H3模型生态,包含专属底模、文本编码器、音视频双VAE的标准化部署方案,用户仅需分类放置模型文件即可快速搭建。内置专属标准化采样参数体系,锁定Euler采样器+Simple调度器、1.0专属CFG蒸馏参数、适配H3模型的专属分辨率与帧数值规则,彻底规避参数错误导致的画面崩坏、动作畸形问题,新手可直接抄参使用,零调试门槛。
在内容生成层面,工作流配套三段式分镜提示词体系与完整武术招式词库,覆盖腿法、拳掌、器械、步法、身法、攻防衔接全品类武术动作,支持单人招式套路、双人实战对打、刀剑枪棍各类兵器武术场景。预设多款成熟通用提示词模板,同时支持自由组合招式、镜头角度、场景氛围与打斗音效,精准区分动态武打动作与静态画面,杜绝人物呆滞、动作堆砌等问题。
为满足不同使用场景需求,LoRA提供多版本可选,适配不同量化规格的FL2VA底模,支持用户对比双训练框架效果,灵活适配个人创作、短视频剪辑、影视动画小样制作等场景。工作流兼容常规画质修复插件,可通过提升采样步数优化低参模糊问题,后续将迭代上线Ref2VA版本,进一步拓展多参考生成能力。整体工作流兼顾专业性、稳定性与实用性,是目前MiniMax H3框架下,还原度最高、适配性最强的专属武打动作生成解决方案。


暂无作品

暂无作品