语音合成 / TTS
这一类用途在全部 8108 个节点仓库里命中 188 个。 下面按下载量列出前 8 个,点进去看每个仓库的适配模型、说明原文与下载入口。
抠图 / 去背景放大 / 超分换脸 / 人脸处理局部重绘 / 修补ControlNet / 结构控制参考图 / 风格迁移视频生成视频插帧 / 补帧数字人 / 口型同步3D 生成语音合成 / TTS语音识别 / 转写音乐 / 歌声生成提示词增强 / 翻译图像反推 / 打标LLM / 对话接入显存优化 / 加速模型加载 / LoRA工作流增强 / 界面批量 / 自动化
1. diodiogod/TTS-Audio-Suite
多引擎 TTS 扩展:统一架构支持 ChatterBox、F5-TTS,以及 RVC 等后续引擎;含模块化引擎适配、角色音色管理、SRT 字幕支持与音频后处理。
音频模型(ACE-Step/Whisper/TTS)
下载 16 万
2. Enemyx-net/VibeVoice-ComfyUI
微软 VibeVoice TTS 模型的 ComfyUI 封装,支持单说话人、多说话人与从文本文件读取。
音频模型(ACE-Step/Whisper/TTS)
下载 10.6 万
3. niknah/ComfyUI-F5-TTS
用 F5-TTS 做文本转语音。
音频模型(ACE-Step/Whisper/TTS)
下载 7.8 万
4. wildminder/ComfyUI-VibeVoice
VibeVoice TTS:表现力强、支持长篇与多说话人的对话式音频。
音频模型(ACE-Step/Whisper/TTS)
下载 6.5 万
5. flybirdxx/ComfyUI-Qwen-TTS
基于 Qwen3-TTS 的语音合成、音色克隆与音色设计节点。
音频模型(ACE-Step/Whisper/TTS) / LLM/VLM(Florence/JoyCaption/Qwen)
下载 5.6 万
6. wildminder/ComfyUI-Chatterbox
Chatterbox 的 TTS 与音色转换节点。
音频模型(ACE-Step/Whisper/TTS)
下载 4.9 万
7. filliptm/ComfyUI_FL-CosyVoice3
基于 CosyVoice3 的文本转语音节点:零样本音色克隆、跨语言合成、指令控制与音色转换;支持 9 种语言与 18 种以上中文方言,模型自动下载并缓存。
音频模型(ACE-Step/Whisper/TTS)
下载 4.1 万
8. stavsap/comfyui-kokoro
用 Kokoro 做 TTS 的节点,可生成并合并说话人以得到新的风格。
音频模型(ACE-Step/Whisper/TTS)
下载 3.5 万
其它用途
抠图 / 去背景命中 471 个仓库
看这一类
放大 / 超分命中 191 个仓库
看这一类
换脸 / 人脸处理命中 54 个仓库
看这一类
局部重绘 / 修补命中 113 个仓库
看这一类
ControlNet / 结构控制命中 321 个仓库
看这一类
参考图 / 风格迁移命中 279 个仓库
看这一类
视频生成命中 1102 个仓库
看这一类
视频插帧 / 补帧命中 29 个仓库
看这一类
知仓学习社