图像反推 / 打标
这一类用途在全部 8108 个节点仓库里命中 157 个。 下面按下载量列出前 8 个,点进去看每个仓库的适配模型、说明原文与下载入口。
抠图 / 去背景放大 / 超分换脸 / 人脸处理局部重绘 / 修补ControlNet / 结构控制参考图 / 风格迁移视频生成视频插帧 / 补帧数字人 / 口型同步3D 生成语音合成 / TTS语音识别 / 转写音乐 / 歌声生成提示词增强 / 翻译图像反推 / 打标LLM / 对话接入显存优化 / 加速模型加载 / LoRA工作流增强 / 界面批量 / 自动化
1. kijai/ComfyUI-Florence2
用 Florence2 视觉语言模型做图像理解类任务:目标检测、图像描述、分割、OCR。
LLM/VLM(Florence/JoyCaption/Qwen)
下载 164 万
2. pythongosssss/ComfyUI-WD14-Tagger
从图像反推 booru 风格标签的扩展。
通用(不限定基座模型)
下载 59.6 万
3. filliptm/ComfyUI_Fill-Nodes
跨领域的综合节点集:图像处理(像素化、切片、遮罩)、视觉效果(故障、半调、像素画)、文件处理(PDF 生成与提取)等。
LLM/VLM(Florence/JoyCaption/Qwen)
下载 51.1 万
4. TTPlanetPig/Comfyui_TTP_Toolset
给 DiT 模型(Flux、Hunyuan、SD3)用的放大节点与配套工作流:先把原图切块,再用 image-interrogator 给每块生成提示词,以获得更准确的放大结果。
SD3/3.5 / Flux
下载 40.2 万
5. EvilBT/ComfyUI_SLK_joy_caption_two
包含 Joy Caption Two、进阶版、加载节点与额外选项节点。
LLM/VLM(Florence/JoyCaption/Qwen)
下载 15.1 万
6. 1038lab/ComfyUI-JoyCaption
基于 LLaVA 模型的图像描述节点,风格化输出;配套的 Caption Tools 节点负责批量处理与描述文本自动分离。
LLM/VLM(Florence/JoyCaption/Qwen)
下载 12 万
7. gokayfem/ComfyUI_VLM_nodes
视觉语言模型(VLM)、大语言模型(LLM)、图像描述、自动提示词生成、创意一致的提示词建议与关键词提取节点。
LLM/VLM(Florence/JoyCaption/Qwen)
下载 7.9 万
8. MieMieeeee/ComfyUI-CaptionThis
用 Janus Pro、Florence2、JoyCaption 等模型描述单张图片或整个目录的图片,侧重为训练 LoRA 准备数据集。
LLM/VLM(Florence/JoyCaption/Qwen)
下载 6.2 万
其它用途
抠图 / 去背景命中 471 个仓库
看这一类
放大 / 超分命中 191 个仓库
看这一类
换脸 / 人脸处理命中 54 个仓库
看这一类
局部重绘 / 修补命中 113 个仓库
看这一类
ControlNet / 结构控制命中 321 个仓库
看这一类
参考图 / 风格迁移命中 279 个仓库
看这一类
视频生成命中 1102 个仓库
看这一类
视频插帧 / 补帧命中 29 个仓库
看这一类
知仓学习社