这是一款基于 Stable Audio 3 Medium Base + T5Gemma Stable Audio 文本编码器 + 分类智能扩写 + Music / Instrument / SFX / One-shot 四类声音模板 + KSampler 音频采样 + VAE 音频解码 的声音资产生成应用。用户只需要输入一句简单的声音需求,选择音频类型和时长,系统就可以生成对应的音乐、乐器素材、音效、环境声或 one-shot 声音资产。
这条流的核心优势是:不是只把一句短提示词直接丢给模型,而是先按声音资产类型重写提示词。 如果用户选择 Music,它会扩写成包含风格、乐器、节奏、情绪、BPM 和时长的完整音乐提示词;如果选择 Instrument,它会生成适合 loop / stem / 乐器片段的提示词;如果选择 SFX,它会强调声源、材质、空间、运动和时间演化;如果选择 One-shot,它会生成短促、孤立、可用于音乐制作或游戏交互的单次声音。适合做短剧配乐、游戏音效、视频转场音、按钮提示音、环境氛围声、乐器 loop、BGM 草稿、影视音效、广告声音素材和 AI 视频配乐资产。使用时建议重点控制四项:用户声音提示词决定生成方向,音频类型决定扩写逻辑,音频时长决定素材长度,随机种子决定可复现性。
🎁先领RH币,再去体验工作流!右上角头像→邀请码→输入【rh-v1111】,立领1000RH币,每天登录还能再领100币~更多ComfyUI工作流、教程和玩法,欢迎关注公众号(AIKSK),抖音 / 哔哩哔哩 / 小红书 / YouTube(AI-KSK)同步更新中✨


暂无作品

暂无作品