这款工作流是基于 LTX2.3 Dev-Dare TIES Distilled 1.1 + 图片参考 + PromptRelay Smart 文本控制 + 三阶图像约束 + 10S相似度保持 + 三阶采样高清精修 构建的图文视频生成系统。用户上传一张参考图和文本提示词后,系统可以生成短视频,同时保证参考主体、动作和风格一致。
核心流程说明:
-
图片参考锁定主体:用户上传的参考图经过图像缩放和预处理后,会进入视频生成的初始约束阶段。这一步确保视频中主体的身份、发型、服装和背景保持与参考图一致。
-
全局提示词控制:用户输入全局提示词,定义整体画面规则,例如角色身份、场景环境、画风、光影效果和镜头规则。全局提示词参与三阶生成,确保视频画面整体风格统一。
-
分段提示词控制动作:分段提示词可以细化每个时间段的动作、表情和镜头变化。例如,角色在前 2 秒微笑,3~5 秒轻微转头,6~10 秒动作收尾。系统会根据这些提示生成每一帧动作的连续性。
-
音频和视频同步(可选):如果附加音频作为参考,系统会提取音频潜空间,保证口型和动作同步。
-
10S相似度保持:通过新增的相似度保持体系,包括人脸检测、相似度引导、锚点感知和 STG 高级引导,确保角色在整个视频中不偏离参考图,动作自然,同时保持高识别度的身份一致性。
-
三阶采样高清精修:视频经过三阶采样后,生成高清精修结果,保证细节精致、画质清晰、无杂乱颗粒或过度锐化。
适用场景:
-
AI短剧和角色分镜:将静态参考图快速生成短片分镜动画
-
角色口播/唱歌视频:单人数字人演绎口播或歌曲
-
商业产品展示:商品参考图动态化呈现
-
游戏概念视频或IP角色演绎:参考概念图生成动态场景
-
社交媒体素材:小红书、B站、抖音等平台动态封面或短片
-
RunningHub 应用场景:提供小白用户一键生成图文视频功能
核心优势:
-
保真度高:参考图主体和角色身份高度保持
-
动作自然:分段提示词控制角色动作和表情连贯
-
视频高清:三阶采样精修输出,细节清晰、画质稳定
-
操作简单:只需上传参考图、输入提示词即可生成短视频
-
快速可复现:随机种子可固定,保证结果一致
-
适用性强:可用于娱乐、商业、教育和内容创作等多种场景
🎁先领RH币,再去体验工作流!右上角头像→邀请码→输入【rh-v1111】,立领1000RH币,每天登录还能再领100币~更多 ComfyUI 工作流、教程和玩法,欢迎关注公众号(AIKSK),抖音 / 哔哩哔哩 / 小红书 / YouTube(AI-KSK)同步更新中✨