创作工具
浏览 496 项 ComfyUI 相关下载与创作资源
种子音频 1.0:文本 + 图像转音频
工作流
上传一张角色图像并编写文本提示词以生成音频。模型从您的图像中提取声音,然后生成语音、环境音、背景音乐和音效。
02 KB
Stable Audio 3.0 Medium Base
工作流
输入一段关于声音、音乐或效果的简短文本描述。该工作流使用Qwen千问扩展您的提示词,并从Stable Audio 3生成一段立体声音频CLIP。
035 KB
Stable Audio 3.0 Medium
工作流
输入一个简短的文本创意、可选的持续时间、种子和类别。使用Stable Audio 3生成立体声音频(音乐、音效或乐器),并带有可选的AI驱动文本扩展。
035 KB
HeyGen:文本转语音
工作流
使用HeyGen先进的TTS引擎从文本生成自然语音,支持多种语言和口音,并提供可自定义的声音。输入文本并从众多预设声音中选择,或通过简短音频样本克隆自定义声音。非常适合为视频创建配音、生成多语言旁白以及制作个性化音频内容。
0633 B
Sonilo:视频配乐生成
工作流
从视频素材生成同步配乐。输入视频以制作与其节奏和情感线索相匹配的音乐,输出完美定时的音频文件。
02 KB
Sonilo:文生音乐
工作流
根据文本提示生成高质量、可用于制作的音乐,输入描述性文字即可创建原创配乐,支持流媒体播放与精确时长控制。
0545 B
ACE-Step 1.5XL 基础版:文本转音乐
工作流
使用40亿参数ACE-Step 1.5 XL模型,从文本提示生成高质量音频。
05 KB
ACE-Step 1.5XL Turbo:文本转音乐
工作流
使用蒸馏的4B ACE-Step模型,从文本提示生成高质量音乐。仅需8次推理步骤即可生成商业级音频,无需CFG。
04 KB
ACE-Step 1.5XL SFT:文生音乐
工作流
使用4B参数SFT模型从文本提示词生成高质量音乐。通过CFG控制输出以实现精确的提示词遵循。
05 KB
ElevenLabs:文生语音
工作流
输入文本以生成超逼真语音,或上传语音样本以克隆用于合成。
01 KB
ElevenLabs:文本转对话
工作流
输入文本并选择语音配置文件,生成高质量、情感丰富的音频对话。
01 KB
ElevenLabs:语音转语音
工作流
上传源音频文件以应用新的语音语调或克隆不同的声音,生成修改后的音频输出。
01 KB