这是一款基于 LTX-2.3 + MSR 多图参考 + 三阶高清增强 的 AI 视频生成应用。
用户可以上传五张参考图,分别用于锁定主要人物、第二人物、第三角色、关键道具和背景场景,再输入一段视频剧情提示词,系统会根据这些参考图生成一段角色和场景更稳定的视频。
和普通图生视频不同,这个流程不是只参考一张图片,而是通过 MSR 多图参考机制,把人物、道具和背景分别作为独立参考输入。前四张图用于控制角色和关键元素,第五张图用于控制背景环境,让最终视频在人物身份、服装、道具形态、场景氛围和画面风格上更一致。
整个流程会自动完成:五张参考图读取、参考图尺寸统一、MSR 多图合成、正向剧情提示词编码、反向提示词约束、一阶身份和构图锁定、二阶 x2 潜空间续接、三阶 x2 高清精修、尾帧裁剪、视频解码、音频解码和最终 MP4 输出。
最终生成的是一段多图参考一致性视频,既能继承参考图中的人物、道具和背景设定,又能根据提示词生成完整动作、镜头推进、剧情变化和电影感画面。
它适合用于多角色剧情视频、人物一致性视频、AI 短剧分镜、节日故事短片、产品角色宣传片、角色 IP 视频、道具驱动剧情、国风幻想视频、横屏高清视频素材和 RunningHub 视频类应用封装。
如果包装成 RunningHub 应用,核心卖点可以直接表达为:
上传五张参考图,输入剧情提示词,一键生成多图锁定的一致性高清视频。