这是一套基于 LTX 2.3 视频扩散模型 + 三阶段采样(Multi-stage Sampling)+ 双重Latent放大(Latent Upscale)+ 音视频联合生成(AV Latent) 的高质量图生视频工作流。系统以输入图像为起点,通过 ImgToVideoConditionOnly 建立初始结构,再经过 三次独立采样(不同CFG + Sigmas)逐层优化画面,实现从基础生成 → 细节增强 → 最终打磨的完整流程。同时结合 LTXVConcatAVLatent 进行音视频融合,使视频在时间维度上保持稳定,并通过 LatentUpsampler + VAEDecodeTiled 提升最终清晰度与细节表现。
相比普通图生视频,这套流的核心优势在于:不是一次生成,而是三次逐级精修,让画面从“能看”提升到“可用级质感”。 特别适合用于高质量短视频、人物动态生成、商业素材制作等场景。使用时重点控制三点:strength(控制像不像原图)、CFG(三阶段强度)、帧数(控制视频长度)。
🎁先领RH币,再去体验工作流!右上角头像→邀请码→输入【rh-v1111】,立领1000RH币,每天登录还能再领100币~更多ComfyUI工作流、教程和玩法,欢迎关注公众号(AIKSK),抖音 / 哔哩哔哩 / 小红书 / YouTube(AI-KSK)同步更新中✨