ZhiHui6/zhihui_nodes_comfyui

55+ ComfyUI自定义节点合集,涵盖提示词生成/扩写、多平台翻译、AI视觉理解、图像处理、视频提示词生成等功能。界面支持中、英文语言。 55+ ComfyUI custom nodes featuring prompt generation/expansion, multi-platform translation, AI vision understanding, image processing, and video prompt tools. Interface supports Chinese and English languages.

176

stars

337

commits

JavaScript

primary language

Sep 8, 2026

updated

comfyui
comfyui-extension
comfyui-nodes
prompt-toolkit
Browse cluster: ComfyUI Custom Nodes and Extensions

README

[English Document]

🎨 潪AI ComfyUI 节点包

完整更新日志:查看CHANGELOG.md

📖 项目介绍

这是一个由 Binity 精心创建的 ComfyUI 自定义节点工具合集,旨在为用户提供一系列实用、高效的节点,以增强和扩展 ComfyUI 的功能。本节点集包含55+功能节点,涵盖文本处理、提示词优化、图像处理、翻译工具、音乐创作辅助、AI视觉理解、Latent处理等多个方面,为您的 AI 创作提供全方位支持。

如果这个项目对您有帮助,请给我们一个⭐Star!您的支持是我们持续改进的动力。

✨ 主要特点

🌍 中文本地化支持

提供专门的中文汉化文件,配合 ComfyUI-DD-Translation 扩展使用,让中文用户能够更便捷地使用各个节点功能。详细说明请参考 Localization_Guide.md

核心功能特色

  • 🔄 多引擎翻译节点:集成百度、腾讯、有道、谷歌在线等5大翻平台,支持中英互译,可自动识别输入语言,自由切换翻译平台。

  • 📝 全面文本处理:提供多行文本编辑、文本合并分离、内容提取修改、语言过滤等文本操作节点。

  • 🎯 智能提示词系统:标签选择器、图像编辑预设、摄影提示词生成器、万相视频提示词生成器等专业的提示词生成工具。

  • 🖼️ 实用图像工具:支持多算法图像缩放、智能切换、颜色移除等等。

⭐ 明星节点

🔥 以下是本节点集中重点推荐的特色节点:

节点名称类别核心功能
标签选择器
TagSelector
提示词处理新一代智能标签管理系统,集成海量预设标签库、自定义标签管理、角色提取器和内置AI扩写功能。提供可视化标签选择界面,支持随机标签生成和多模式扩写。
摄影提示词生成器
PhotographPromptGenerator
提示词处理专业摄影风格提示词生成器,涵盖人物、场景、镜头、光线、服装等16个维度。支持输出模式切换(标签组合/模板文本),集成AI扩写功能。配有用户自定义选项扩展和模板编辑助手界面。
LM工作室节点
LMStudioNode
AI视觉理解连接本地LM Studio服务器的视觉理解节点,支持图像分析和文本生成。通过LM Studio本地部署的大模型,实现无需云端API的私有化图像分析。支持多种预设模板、输出语言控制和多图像输入。

💡 使用建议:新用户建议从 标签选择器摄影提示词生成器 开始体验,快速提升您的创作灵感和效率。


🛠️ 节点功能说明

本节点集包含众多功能各异的节点,分为以下几个主要类别:

📝 文本处理类节点

节点名称功能描述
多行文本
MultiLineTextNode
提供一个支持多行输入的文本框,并带注释功能。
优先级文本切换
PriorityTextSwitch
优先级文本切换节点:当同时接入文本A和文本B端口时,优先输出B端口;如果B端口为空或未连接,则输出文本A端口;如果两个端口都为空,则返回空字符串。

特点

  • 优先级控制:文本B端口优先级高于文本A端口
  • 智能切换:自动检测输入状态,空值时回退到A或输出空文本

提示词合并器(可注释)
TextCombinerNode
合并两个文本输入,并可通过独立的开关控制每个文本的输出,并带注释功能。可用于动态组合不同的提示词部分,灵活构建完整提示。
文本合并器
TextMergerNode
将多个文本输入合并为一个输出文本,支持灵活配置输入端口数量。user_text 输入框内容优先显示在最前面,后续通过 inputcount 滑块控制 text_2text_N 端口数量。所有非空文本按顺序用分隔符连接,适用于批量合并多个提示词或文本片段。
文本修改器
TextModifier
根据指定的起始和结束标记提取文本内容,并自动去除多余的空白字符。适合从复杂文本中提取特定部分,或进行格式清理。
中英文本提取器
TextExtractor
从混合文本中提取纯中文或纯英文字符,支持标点和数字的提取,并自动清理格式。对于处理双语提示词或分离不同语言内容非常有用。

提示词删除
PromptDelete
提示词删除节点:支持动态数量的查找与删除操作,适合批量删除不需要的触发词、风格词或模型相关文本。并支持自动格式化功能,清理残留符号。
提示词替换
PromptReplace
提示词替换节点:支持动态数量的查找与替换操作,适合批量替换触发词、风格词或模型相关文本。
显示任何
ShowAny
用于在ComfyUI界面中显示任意类型内容的节点,支持多行文本展示,可实时显示上游节点传递的文本信息,便于调试和查看中间结果。支持标准模式和排错模式两种显示方式。
文本编辑器(继续运行)
TextEditorWithContinue
交互式文本编辑节点,暂停工作流执行并提供可编辑文本区域,用户可在运行时修改文本内容,点击继续按钮恢复工作流执行。

特点

  • 工作流暂停:自动暂停工作流执行,等待用户交互
  • 实时编辑:提供可编辑文本区域,支持多行文本编辑
  • 自动同步:节点暂停时自动获取并同步输入文本
  • 内置帮助:点击节点右上角帮助按钮查看使用说明

使用场景

  • 工作流中需要人工干预和文本调整的场景
  • 提示词的实时优化和调试

字体设计师
TypeDesigner
提供可视化界面,让用户浏览和选择各种字体艺术风格(如3D、霓虹、金属等),自动提供对应的预设提示词,方便进行艺术字创作。

� 提示词处理类节点

节点名称功能描述
图像编辑预设
ImageEditingPresets
提供专业的图像编辑预设库,包含多种专业预设,为图像生成提供风格化指导,帮助用户快速应用常见的艺术风格和效果。
摄影提示词生成器
PhotographPromptGenerator

根据预设的摄影要素(如相机、镜头、光照、场景等)组合生成专业的摄影风格提示词。

特点

  • 支持从自定义文本文件加载选项,灵活扩展
  • 支持随机选择,增加创意多样性
  • 输出模板可自定义,适应不同的摄影风格需求
万相视频提示词生成器
WanPromptGenerator

基于万相2.2官方文档编写的全能型提示词生成器,支持自定义和预设两种组合方法,涵盖运镜、场景、光线、构图等16个维度的专业视频提示词生成。

特点

  • 双模式切换:支持自定义组合和预设组合模式,通过开关按钮一键切换
  • 多维度选择:涵盖主体类型、场景类型、光源类型、光线类型、时间段、景别、构图、镜头焦段、机位角度、镜头类型、色调、运镜方式、人物情绪、运动类型、视觉风格、特效镜头、动作姿势17个专业维度
  • 智能扩写:支持多种LLM模型免费在线扩写
提示词预设 - 单选
PromptPresetOneChoice
提供6个预设选项,用户可以方便地在不同预设之间切换。适合保存常用的提示词模板,快速应用到不同场景。
提示词预设 - 多选
PromptPresetMultipleChoice
支持同时选择多个预设,并将它们合并输出,每个预设都带有独立的开关和注释功能。适合构建复杂的组合提示词,灵活控制各部分的启用状态。
触发词合并器
TriggerWordMerger
将特定的触发词(Trigger Words)与主文本智能合并,并支持权重控制(例如 (word:1.5))。适用于添加模型特定的触发词或风格词,并精确控制其影响强度。
系统引导词加载器
SystemPromptLoader
从预设文件夹动态加载系统级引导词(System Prompt),并可选择性地与用户输入合并。适合管理和应用复杂的系统提示模板,提高生成结果的一致性和质量。

额外选项列表
ExtraOptions
一个通用的额外选项列表,类似于 JoyCaption 的设计,设有总开关和独立的引导词输入框。适合添加辅助提示或控制参数,增强工作流的灵活性。

提示词卡选择器
PromptCardSelector
支持随机/顺序抽取模式、单卡/多卡加载、多种分割方式及卡池洗牌策略,内置卡池管理器提供浏览/搜索/编辑功能,支持导入/导出卡文件,适用于提示词组合与批量管理。

特点

  • 双抽取模式:支持随机抽取和顺序抽取两种模式
  • 多卡加载:支持单卡和多卡加载模式
  • 灵活分割:支持多种文本分割方式(空白行、换行符等)
  • 卡池管理:内置卡池管理器,提供浏览、搜索、编辑功能
  • 导入导出:支持提示卡文件的导入和导出
  • 洗牌策略:支持卡池洗牌策略,增加随机性

提示词图库
PromptGallery
提示词图库节点:从指定目录加载包含缩略图和文本的图文库,从用户选择的图片输出与图片同名的 .txt 文件内容(提示词文本)。适用于将"图像-提示词"成对管理并在工作流中快速取用。
提示词扩写器
PromptExpander
使用AI大模型将简短的提示词扩展为详细、高质量的内容。

特点

  • 双核心风格:支持自然语言式扩写和标签式扩写两种核心风格
  • 多平台支持:支持OpenAI、Anthropic、Google、智谱AI、深度求索、硅基流动、月之暗面、稀宇科技、阿里云、OpenRouter、腾讯、英伟达等平台
  • 自定义提示词:支持完全自定义系统提示词,满足个性化需求
  • 多语言输出:支持中文和英文两种输出语言

🖼️ 图像处理类节点

节点名称功能描述
获取图像尺寸
GetImageSizes
提取输入图像的宽度和高度信息,并在节点上实时显示尺寸预览。支持多种图像格式输入,提供准确的像素尺寸信息。
图像宽高比设置
ImageAspectRatio
智能图像宽高比设置工具,支持多种预设模式和自定义尺寸配置。

特点

  • 多预设支持:内置Qwen、Flux、Wan、SDXL、LTX2.3等主流模型的专用宽高比预设
  • 自定义模式:支持完全自定义的宽度和高度设置
  • 宽高比锁定:提供宽高比锁定功能,修改一个维度时自动调整另一个维度
  • 尺寸互换:一键互换宽高数值,方便调整横竖屏方向


图像缩放器
ImageScaler
提供多种插值算法对图像进行缩放,并可选择保持原始宽高比。支持高质量的图像尺寸调整,适用于预处理或后处理阶段。
颜色移除
ColorRemoval
从图像中移除彩色,输出灰度图像。适用于创建黑白效果或作为特定图像处理流程的预处理步骤。

颜色移除节点展示
图像旋转工具
ImageRotateTool

专业的图像旋转和翻转工具,支持预设角度和自定义角度旋转。

特点

  • 预设旋转:提供90°、180°、270°、360°快速旋转选项
  • 翻转功能:支持垂直翻转和水平翻转操作
  • 自定义角度:支持-360°到360°范围内的精确角度旋转
  • 画布处理:可选择扩展画布或裁剪空白两种处理模式
  • 批量处理:支持批量图像的同时处理

图像预览/对比
PreviewOrCompareImages
多功能图像预览和对比节点,支持单张图像预览或两张图像的并排对比显示。image_1为必需输入,image_2为可选输入,当提供两张图像时自动启用对比模式。

特点

  • 双模式智能切换:根据输入单图或双图自动切换预览或对比模式
  • 交互式对比:鼠标悬停时显示滑动分割线进行直观对比

图像格式转换器
ImageFormatConverter

专业的图像格式转换工具,支持批量转换多种图像格式,具备智能格式检测和高级压缩选项。

支持格式

  • 输出格式:JPEG、PNG、WEBP、BMP、TIFF
  • 输入格式:自动检测所有常见图像格式

特点

  • 批量处理:支持文件夹批量转换,自动创建输出目录
  • 质量控制:1-100可调质量参数,精确控制文件大小和画质
  • 高级选项:支持优化压缩、渐进式编码、无损压缩
  • 智能检测:基于文件内容而非扩展名的格式检测
  • 详细报告:提供转换过程的详细信息和统计数据

批量图像加载器
BatchLoadingOfImages

从指定目录批量加载图像文件,支持多种排序方式和加载控制。

特点

  • 批量加载:从文件夹批量加载图像,支持JPG、PNG、WEBP、JXL等格式
  • 多种排序:支持按字母、数字、日期时间等升序/降序排列
  • 加载控制:支持设置起始索引和加载数量限制
  • 实时刷新:支持始终重新加载模式,实时获取最新文件

🎞️ 电影后期处理类节点

节点名称功能描述
胶片颗粒效果
FilmGrain

为图像添加逼真的胶片颗粒效果,营造经典胶片质感。

  • 双分布模式:支持高斯分布(自然胶片噪点)和平均分布(数字均匀噪点)
  • 饱和度混合:独立控制彩色/单色颗粒比例,实现从彩色胶片到黑白胶片的平滑过渡

拉普拉斯锐化
LaplacianSharpen
基于拉普拉斯算子的边缘锐化工具,通过二阶微分检测图像边缘并增强细节,适合风景和人像的细节增强。
索贝尔锐化
SobelSharpen
采用索贝尔算子的方向性锐化工具,通过梯度计算同时增强水平和垂直边缘,适合需要强调纹理的场景。
USM锐化
USMSharpen
使用经典USM锐化技术来增强细节,对目标图像进行自然的锐化处理。
色彩匹配
ColorMatchToReference
智能色彩匹配工具,可将参考图像的色调风格应用到目标图像,实现专业级色彩统一。

🎬 视频处理类节点

节点名称功能描述
视频帧提取器
VideoFrameExtractor
专业的视频帧提取工具,支持从视频文件中提取指定数量的帧或按间隔提取帧,适用于视频分析、预览和后续处理。

特点

  • 双提取模式:支持按数量提取(均匀分布)和按间隔提取两种模式
  • 可选保存:支持将提取的帧保存到指定目录

🎵 音乐相关节点

节点名称功能描述
Suno歌词生成器
SunoLyricsGenerator
专业的AI歌词创作工具,基于在线LLM生成结构化的可演唱歌词,支持多种音乐风格和语言。
Suno歌曲风格提示词生成器
SunoSongStylePromptGenerator
专业的歌曲风格提示词生成工具,结合用户偏好和音乐元素,生成结构化的Suno风格提示词,用于快速构建风格一致的歌曲。
音频时长计算器
AudioDuration
计算音频文件的时长信息,输出秒数、格式化时间和毫秒数三种格式。

特点

  • 多格式输出:同时输出秒数、格式化时间(HH:MM:SS.mmm)和毫秒数
  • 自动适配:自动适配不同维度的音频张量
  • 精确计算:基于采样率进行精确时长计算

🤖 AI视觉理解节点

节点名称功能描述
Qwen3-VL基础版
Qwen3VLBasic
基于阿里巴巴Qwen3-VL模型的基础视觉理解节点,提供简洁高效的图像和视频分析功能,支持多种模型版本和量化选项,为Qwen3-VL高级版简化而来的版本。
Qwen3-VL高级版
Qwen3VLAdvanced
基于阿里巴巴Qwen3-VL模型的专业级视觉理解节点,集成众多预设提示词模板,支持智能批量处理、高级量化技术和思维链推理功能。提供从标签生成到创意分析的多种预设模式,具备解锁限制、多语言输出、批量处理等高级特性。

参数详解文档Qwen3VL_Parameters_Guide.md


Qwen3-VL在线版
Qwen3VLAPI
功能强大的云端视觉理解节点,支持多平台在线API调用和批量图像分析,提供丰富的模型选择和灵活的配置方式。

支持平台

  • 硅基流动平台、魔搭社区平台、自定义API

核心特点

  • 云端部署:无需本地GPU,通过API调用云端模型
  • 双重配置模式:平台预设和完全自定义两种模式
  • 批量处理:支持文件夹批量处理,自动保存结果

Qwen3-VL额外选项
Qwen3VLExtraOptions
为Qwen3-VL节点提供详细的输出控制选项,包括人物信息、光照分析、相机角度、水印检测等高级配置参数。
Qwen3-VL图像加载器
ImageLoader
专为Qwen3-VL优化的图像加载节点,支持多种图像格式和批量加载功能。
Qwen3-VL视频加载器
VideoLoader
专为Qwen3-VL优化的视频加载节点,支持多种视频格式和帧提取功能。
Qwen3-VL多路径输入
MultiplePathsInput
支持同时处理多个文件路径的输入节点,便于批量处理图像和视频文件。
Qwen3-VL路径切换器
PathSwitch
双通道路径切换器,支持手动和自动两种切换模式。可在2个来自MultiplePathsInput节点的路径输入之间智能切换,支持注释标签便于管理。手动模式下可指定选择通道,自动模式下智能选择第一个非空输入,适用于工作流中的条件分支和动态切换。输出可直接连接到Qwen3-VL高级版的source_path输入。
Florence2 Plus
Florence2Plus
基于微软Florence-2视觉理解模型的专业图像分析节点,支持多种任务类型和批量处理功能。

核心特性

  • 多模型支持:支持Microsoft Florence-2基础和大型模型,以及MiaoshouAI PromptGen系列
  • 丰富任务类型:支持标题生成、详细描述、标签生成、混合模式、分析模式等7种任务
  • 批量处理:支持单张图片、多张图片和整个文件夹的批量处理
  • 性能优化:支持fp16/bf16/fp32精度,flash_attention_2/sdpa/eager注意力机制
  • 智能内存管理:提供卸载到CPU、完全卸载、保持加载三种内存管理模式

使用建议

  • 基础任务使用Microsoft模型,复杂任务使用MiaoshouAI PromptGen模型
  • 显存充足时使用bf16获得最佳质量,有限时使用fp16平衡性能
  • 根据使用频率选择合适的内存管理模式

Sa2VA高级版
Sa2VAAdvanced
基于字节跳动Sa2VA模型的专业级图像分割节点,提供精确的智能分割功能,支持多种模型版本和量化配置。通过自然语言提示词控制分割区域,实现对图像中特定对象的精准分割,输出高质量的遮罩数据。

核心功能

  • 智能分割:基于自然语言提示词进行精确的图像对象分割
  • 多模型支持:支持多种Sa2VA模型版本,包括InternVL3和Qwen系列
  • 量化优化:提供4bit和8bit量化选项,优化性能和资源使用
  • Flash Attention:支持Flash Attention技术,提升推理效率
  • 模型管理:内置模型下载和管理功能,支持本地缓存
Sa2VA分割预设
Sa2VASegmentationPreset
提供交互式分割预设选择的工具节点,可在界面中选择常见部位/对象并生成中文分割提示文本输出,用于驱动 Sa2VA 高级版的分割。将本节点的 segmentation_preset 输出连接到 Sa2VA 高级版的同名输入即可生效。若该输入为空,Sa2VA 高级版将改用字符串输入框中的 segmentation_prompt
LM Studio节点
LMStudioNode
连接本地LM Studio服务器的视觉理解节点,支持图像分析和文本生成。通过LM Studio本地部署的大模型,实现无需云端API的私有化图像分析。

前置要求

  • 需要安装 LM Studio 软件,下载地址:https://lmstudio.ai
  • 在LM Studio中下载并加载支持视觉能力的模型(如Qwen2-VL、Llama-Vision等)
  • 启动LM Studio的本地服务器功能(默认端口1234)

核心功能

  • 本地部署:连接本地LM Studio服务器,无需云端API密钥
  • 多种预设模板:支持标签反推、详细描述、创意写作等多种提示词预设
  • 输出语言控制:支持中文、英文、中英双语等多种输出语言
  • 模型自动发现:自动获取LM Studio中已加载的模型列表
  • 模型刷新:一键刷新按钮,当模型列表显示异常时可重新获取
  • 多图像输入:支持最多4张图像同时输入进行单轮推理
  • 推理日志面板:实时显示推理日志,仅显示当前运行信息
  • 可视化设置:提供状态设置界面,方便配置参数

配套节点

  • LM Studio模型卸载:一键卸载LM Studio中已加载的模型,释放显存

⚙️ 逻辑与工具类节点

节点名称功能描述
🏷️TAG标签选择器
TagSelector

新一代智能标签管理系统,集成海量预设标签库、自定义标签功能、角色提取器和内置AI扩写能力,提供前所未有的标签选择体验,快速构建复杂提示词,提升创作效率。

核心功能

  • 标签分类丰富:涵盖常规标签、艺术题材、人物属性、场景环境等全方位分类
  • 自定义标签管理:支持添加、编辑、删除个人专属标签,打造个性化标签库
  • 智能搜索定位:支持关键词搜索,快速找到目标标签
  • 实时选择统计:动态显示已选标签数量和详细列表
  • 随机标签生成:智能随机标签生成功能,支持按分类权重和数量配置自动生成多样化标签组合
  • 角色提取器:从远程服务器获取角色数据,自动生成AI绘图提示词,支持历史记录管理
  • 内置AI扩写:一键智能扩写功能,支持标签式和自然语言式两种扩写模式

参数说明

  • tag_edit:手动编辑的标签文本,支持直接输入或粘贴
  • random_logic:随机逻辑选择(Disabled/Random Tags/Character Extractor)
    • Disabled:禁用随机功能
    • Random Tags:使用随机标签界面中配置的规则生成标签
    • Character Extractor:使用角色提取器功能获取标签
  • expand_mode:扩写模式选择(Disabled/Tag Style/Natural Language/Structured JSON)
  • output_language:扩写结果语言(Chinese/English)
  • platform:API平台选择(auto自动选择可用平台)
  • max_tokens:AI生成内容的最大令牌数

Latent切换器(双模式)
LatentSwitchDualMode
支持可变数量的潜变量输入的双模式切换器。通过滑块 inputcount 控制端口数量,并点击按钮 Update inputs 同步增删端口;手动模式下按索引选择输出(select_channel 选项随 inputcount 自动更新);自动模式仅在存在唯一非空输入时输出,检测到多个非空输入将提示错误。新增的潜变量输入端口均为非必连,适合在不同生成路径之间灵活切换与对比实验。
文本切换器(双模式)
TextSwitchDualMode
支持可变数量的文本输入的双模式切换器。通过滑块 inputcount 控制端口数量,并点击按钮 Update inputs 同步增删端口;手动模式下按索引选择输出(select_text 选项随 inputcount 自动更新);自动模式仅在存在唯一非空输入时输出,检测到多个非空输入将提示错误。新增的文本输入端口均为非必连,适合在不同版本提示词之间灵活切换与对比实验。
图像切换器(双模式)
ImageSwitchDualMode
支持可变数量的图像输入的双模式切换器。通过滑块 inputcount 控制端口数量,并点击按钮 Update inputs 同步增删端口;手动模式下按索引选择输出(select_image 选项随 inputcount 自动更新);自动模式仅在存在唯一非空输入时输出,检测到多个非空输入将提示错误。新增的图像输入端口均为非必连,便于在不同生成结果或不同处理路径之间进行灵活对比。
优先级图像切换
PriorityImageSwitch
智能优先级图像切换节点,当同时接入图像A和图像B端口时,优先输出B端口的内容;如果B端口无输入,则输出图像A端口的内容;如果两个端口都无输入,则弹出提示要求至少连接一个输入端口。

特点

  • 优先级控制:图像B端口优先级高于图像A端口
  • 智能切换:自动检测输入状态,无缝切换输出,减少手动切换操作

多平台翻译
MultiPlatformTranslate

多平台翻译节点,支持百度、阿里云、有道、智谱AI和免费翻译服务。用户可以通过配置管理界面设置各平台的API密钥,实现高质量的专业翻译服务。

特点

  • 多平台支持:支持主流翻译平台,满足不同需求
  • 配置管理:通过图形化界面轻松管理各平台API密钥
  • 专业翻译:提供高质量的专业翻译服务
资源清理器
ResourceCleaner

系统资源清理工具,提供独立的内存(RAM)、显存(VRAM)和缓存清理控制,可选择性释放系统资源。

特点

  • 独立控制:三个清理功能配备独立开关,可单独或组合使用
  • 详细报告:输出清理过程的详细报告,便于监控资源释放情况
工作流暂停器
PauseWorkflow

智能工作流控制节点,可在任意位置暂停工作流执行,等待用户交互后继续或取消执行。

特点

  • 通用输入:支持任意类型的数据输入和输出,可插入工作流的任何位置
  • 交互式控制:提供继续和取消两个操作选项
  • 状态管理:智能管理每个节点实例的暂停状态
  • 异常处理:取消时抛出中断异常,安全终止工作流
预留显存设置器
ReservedVRAMSetter

专业的GPU显存预留管理工具,用于控制ComfyUI的显存使用策略,有效防止显存溢出(OOM)错误,提升工作流稳定性。支持手动和自动两种模式,自动模式可根据当前GPU使用情况智能计算合适的预留显存量。

特点

  • 双模式支持:手动模式固定设置预留显存量,自动模式根据当前GPU使用情况智能调整
  • 智能清理:支持在设置前自动清理GPU显存,释放无用资源
  • 自动限制:自动模式下可设置最大预留上限,防止过度预留影响其他应用
  • 种子控制:内置随机种子管理,确保工作流的一致性

预留显存设置器
整数节点
IntNode

输出可配置整数值的工具节点,用于统一的参数控制。支持-2147483648到2147483647范围的整数输入,适用于需要精确数值控制的场景。


整数节点
组开关管理器
GroupSwitchManager

可视化群组开关管理工具,自动检测工作流中的所有群组,提供一键启用/禁用功能,支持颜色过滤、标题匹配、拖拽排序和群组联动配置。

核心功能

  • 智能过滤:支持按颜色或标题关键词筛选群组
  • 拖拽排序:自定义群组显示顺序
  • 联动配置:配置群组间的联动规则,实现开关联动效果
  • 快速导航:点击箭头快速定位到对应群组位置
  • 双模式支持:支持禁用模式和忽略模式


🚀 安装方式

📦 方式一:通过 ComfyUI Manager 安装(推荐)

  1. 安装 ComfyUI Manager
  2. 在 Manager 菜单中选择 "Install Custom Nodes"
  3. 搜索 zhihui_nodes_comfyui 并点击 "Install" 按钮
  4. 等待安装完成后重启 ComfyUI,即可在节点菜单中找到新添加的节点

🔧 方式二:通过 Git 安装

进入 ComfyUI 的 custom_nodes 目录,执行以下命令:

git clone https://github.com/ZhiHui6/zhihui_nodes_comfyui.git

重启 ComfyUI 即可使用。

📁 方式三:手动安装

  1. 下载本仓库的 ZIP 文件并解压
  2. 将整个 zhihui_nodes_comfyui 文件夹复制到 ComfyUI 的 custom_nodes 目录下
  3. 重启 ComfyUI

📋 依赖项

本节点集大部分功能无需额外依赖,开箱即用。部分在线功能(如翻译、提示词优化)需要网络连接。

如需手动安装依赖,可执行:

pip install -r requirements.txt

🤝 贡献指南

我们欢迎各种形式的贡献,包括但不限于:

[🔴报告问题和提出建议 ] | [💡提交功能请求] | [📚改进文档] | [💻提交代码贡献]

如果您有任何想法或建议,请随时提出 Issue 或 Pull Request。

Contributors

ZhiHui6

337 commits

ZhiHui6/zhihui_nodes_comfyui

55+ ComfyUI自定义节点合集,涵盖提示词生成/扩写、多平台翻译、AI视觉理解、图像处理、视频提示词生成等功能。界面支持中、英文语言。 55+ ComfyUI custom nodes featuring prompt generation/expansion, multi-platform translation, AI vision understanding, image processing, and video prompt tools. Interface supports Chinese and English languages.

176

stars

337

commits

JavaScript

primary language

Sep 8, 2026

updated

comfyui
comfyui-extension
comfyui-nodes
prompt-toolkit
Browse cluster: ComfyUI Custom Nodes and Extensions

README

[English Document]

🎨 潪AI ComfyUI 节点包

完整更新日志:查看CHANGELOG.md

📖 项目介绍

这是一个由 Binity 精心创建的 ComfyUI 自定义节点工具合集,旨在为用户提供一系列实用、高效的节点,以增强和扩展 ComfyUI 的功能。本节点集包含55+功能节点,涵盖文本处理、提示词优化、图像处理、翻译工具、音乐创作辅助、AI视觉理解、Latent处理等多个方面,为您的 AI 创作提供全方位支持。

如果这个项目对您有帮助,请给我们一个⭐Star!您的支持是我们持续改进的动力。

✨ 主要特点

🌍 中文本地化支持

提供专门的中文汉化文件,配合 ComfyUI-DD-Translation 扩展使用,让中文用户能够更便捷地使用各个节点功能。详细说明请参考 Localization_Guide.md

核心功能特色

  • 🔄 多引擎翻译节点:集成百度、腾讯、有道、谷歌在线等5大翻平台,支持中英互译,可自动识别输入语言,自由切换翻译平台。

  • 📝 全面文本处理:提供多行文本编辑、文本合并分离、内容提取修改、语言过滤等文本操作节点。

  • 🎯 智能提示词系统:标签选择器、图像编辑预设、摄影提示词生成器、万相视频提示词生成器等专业的提示词生成工具。

  • 🖼️ 实用图像工具:支持多算法图像缩放、智能切换、颜色移除等等。

⭐ 明星节点

🔥 以下是本节点集中重点推荐的特色节点:

节点名称类别核心功能
标签选择器
TagSelector
提示词处理新一代智能标签管理系统,集成海量预设标签库、自定义标签管理、角色提取器和内置AI扩写功能。提供可视化标签选择界面,支持随机标签生成和多模式扩写。
摄影提示词生成器
PhotographPromptGenerator
提示词处理专业摄影风格提示词生成器,涵盖人物、场景、镜头、光线、服装等16个维度。支持输出模式切换(标签组合/模板文本),集成AI扩写功能。配有用户自定义选项扩展和模板编辑助手界面。
LM工作室节点
LMStudioNode
AI视觉理解连接本地LM Studio服务器的视觉理解节点,支持图像分析和文本生成。通过LM Studio本地部署的大模型,实现无需云端API的私有化图像分析。支持多种预设模板、输出语言控制和多图像输入。

💡 使用建议:新用户建议从 标签选择器摄影提示词生成器 开始体验,快速提升您的创作灵感和效率。


🛠️ 节点功能说明

本节点集包含众多功能各异的节点,分为以下几个主要类别:

📝 文本处理类节点

节点名称功能描述
多行文本
MultiLineTextNode
提供一个支持多行输入的文本框,并带注释功能。
优先级文本切换
PriorityTextSwitch
优先级文本切换节点:当同时接入文本A和文本B端口时,优先输出B端口;如果B端口为空或未连接,则输出文本A端口;如果两个端口都为空,则返回空字符串。

特点

  • 优先级控制:文本B端口优先级高于文本A端口
  • 智能切换:自动检测输入状态,空值时回退到A或输出空文本

提示词合并器(可注释)
TextCombinerNode
合并两个文本输入,并可通过独立的开关控制每个文本的输出,并带注释功能。可用于动态组合不同的提示词部分,灵活构建完整提示。
文本合并器
TextMergerNode
将多个文本输入合并为一个输出文本,支持灵活配置输入端口数量。user_text 输入框内容优先显示在最前面,后续通过 inputcount 滑块控制 text_2text_N 端口数量。所有非空文本按顺序用分隔符连接,适用于批量合并多个提示词或文本片段。
文本修改器
TextModifier
根据指定的起始和结束标记提取文本内容,并自动去除多余的空白字符。适合从复杂文本中提取特定部分,或进行格式清理。
中英文本提取器
TextExtractor
从混合文本中提取纯中文或纯英文字符,支持标点和数字的提取,并自动清理格式。对于处理双语提示词或分离不同语言内容非常有用。

提示词删除
PromptDelete
提示词删除节点:支持动态数量的查找与删除操作,适合批量删除不需要的触发词、风格词或模型相关文本。并支持自动格式化功能,清理残留符号。
提示词替换
PromptReplace
提示词替换节点:支持动态数量的查找与替换操作,适合批量替换触发词、风格词或模型相关文本。
显示任何
ShowAny
用于在ComfyUI界面中显示任意类型内容的节点,支持多行文本展示,可实时显示上游节点传递的文本信息,便于调试和查看中间结果。支持标准模式和排错模式两种显示方式。
文本编辑器(继续运行)
TextEditorWithContinue
交互式文本编辑节点,暂停工作流执行并提供可编辑文本区域,用户可在运行时修改文本内容,点击继续按钮恢复工作流执行。

特点

  • 工作流暂停:自动暂停工作流执行,等待用户交互
  • 实时编辑:提供可编辑文本区域,支持多行文本编辑
  • 自动同步:节点暂停时自动获取并同步输入文本
  • 内置帮助:点击节点右上角帮助按钮查看使用说明

使用场景

  • 工作流中需要人工干预和文本调整的场景
  • 提示词的实时优化和调试

字体设计师
TypeDesigner
提供可视化界面,让用户浏览和选择各种字体艺术风格(如3D、霓虹、金属等),自动提供对应的预设提示词,方便进行艺术字创作。

� 提示词处理类节点

节点名称功能描述
图像编辑预设
ImageEditingPresets
提供专业的图像编辑预设库,包含多种专业预设,为图像生成提供风格化指导,帮助用户快速应用常见的艺术风格和效果。
摄影提示词生成器
PhotographPromptGenerator

根据预设的摄影要素(如相机、镜头、光照、场景等)组合生成专业的摄影风格提示词。

特点

  • 支持从自定义文本文件加载选项,灵活扩展
  • 支持随机选择,增加创意多样性
  • 输出模板可自定义,适应不同的摄影风格需求
万相视频提示词生成器
WanPromptGenerator

基于万相2.2官方文档编写的全能型提示词生成器,支持自定义和预设两种组合方法,涵盖运镜、场景、光线、构图等16个维度的专业视频提示词生成。

特点

  • 双模式切换:支持自定义组合和预设组合模式,通过开关按钮一键切换
  • 多维度选择:涵盖主体类型、场景类型、光源类型、光线类型、时间段、景别、构图、镜头焦段、机位角度、镜头类型、色调、运镜方式、人物情绪、运动类型、视觉风格、特效镜头、动作姿势17个专业维度
  • 智能扩写:支持多种LLM模型免费在线扩写
提示词预设 - 单选
PromptPresetOneChoice
提供6个预设选项,用户可以方便地在不同预设之间切换。适合保存常用的提示词模板,快速应用到不同场景。
提示词预设 - 多选
PromptPresetMultipleChoice
支持同时选择多个预设,并将它们合并输出,每个预设都带有独立的开关和注释功能。适合构建复杂的组合提示词,灵活控制各部分的启用状态。
触发词合并器
TriggerWordMerger
将特定的触发词(Trigger Words)与主文本智能合并,并支持权重控制(例如 (word:1.5))。适用于添加模型特定的触发词或风格词,并精确控制其影响强度。
系统引导词加载器
SystemPromptLoader
从预设文件夹动态加载系统级引导词(System Prompt),并可选择性地与用户输入合并。适合管理和应用复杂的系统提示模板,提高生成结果的一致性和质量。

额外选项列表
ExtraOptions
一个通用的额外选项列表,类似于 JoyCaption 的设计,设有总开关和独立的引导词输入框。适合添加辅助提示或控制参数,增强工作流的灵活性。

提示词卡选择器
PromptCardSelector
支持随机/顺序抽取模式、单卡/多卡加载、多种分割方式及卡池洗牌策略,内置卡池管理器提供浏览/搜索/编辑功能,支持导入/导出卡文件,适用于提示词组合与批量管理。

特点

  • 双抽取模式:支持随机抽取和顺序抽取两种模式
  • 多卡加载:支持单卡和多卡加载模式
  • 灵活分割:支持多种文本分割方式(空白行、换行符等)
  • 卡池管理:内置卡池管理器,提供浏览、搜索、编辑功能
  • 导入导出:支持提示卡文件的导入和导出
  • 洗牌策略:支持卡池洗牌策略,增加随机性

提示词图库
PromptGallery
提示词图库节点:从指定目录加载包含缩略图和文本的图文库,从用户选择的图片输出与图片同名的 .txt 文件内容(提示词文本)。适用于将"图像-提示词"成对管理并在工作流中快速取用。
提示词扩写器
PromptExpander
使用AI大模型将简短的提示词扩展为详细、高质量的内容。

特点

  • 双核心风格:支持自然语言式扩写和标签式扩写两种核心风格
  • 多平台支持:支持OpenAI、Anthropic、Google、智谱AI、深度求索、硅基流动、月之暗面、稀宇科技、阿里云、OpenRouter、腾讯、英伟达等平台
  • 自定义提示词:支持完全自定义系统提示词,满足个性化需求
  • 多语言输出:支持中文和英文两种输出语言

🖼️ 图像处理类节点

节点名称功能描述
获取图像尺寸
GetImageSizes
提取输入图像的宽度和高度信息,并在节点上实时显示尺寸预览。支持多种图像格式输入,提供准确的像素尺寸信息。
图像宽高比设置
ImageAspectRatio
智能图像宽高比设置工具,支持多种预设模式和自定义尺寸配置。

特点

  • 多预设支持:内置Qwen、Flux、Wan、SDXL、LTX2.3等主流模型的专用宽高比预设
  • 自定义模式:支持完全自定义的宽度和高度设置
  • 宽高比锁定:提供宽高比锁定功能,修改一个维度时自动调整另一个维度
  • 尺寸互换:一键互换宽高数值,方便调整横竖屏方向


图像缩放器
ImageScaler
提供多种插值算法对图像进行缩放,并可选择保持原始宽高比。支持高质量的图像尺寸调整,适用于预处理或后处理阶段。
颜色移除
ColorRemoval
从图像中移除彩色,输出灰度图像。适用于创建黑白效果或作为特定图像处理流程的预处理步骤。

颜色移除节点展示
图像旋转工具
ImageRotateTool

专业的图像旋转和翻转工具,支持预设角度和自定义角度旋转。

特点

  • 预设旋转:提供90°、180°、270°、360°快速旋转选项
  • 翻转功能:支持垂直翻转和水平翻转操作
  • 自定义角度:支持-360°到360°范围内的精确角度旋转
  • 画布处理:可选择扩展画布或裁剪空白两种处理模式
  • 批量处理:支持批量图像的同时处理

图像预览/对比
PreviewOrCompareImages
多功能图像预览和对比节点,支持单张图像预览或两张图像的并排对比显示。image_1为必需输入,image_2为可选输入,当提供两张图像时自动启用对比模式。

特点

  • 双模式智能切换:根据输入单图或双图自动切换预览或对比模式
  • 交互式对比:鼠标悬停时显示滑动分割线进行直观对比

图像格式转换器
ImageFormatConverter

专业的图像格式转换工具,支持批量转换多种图像格式,具备智能格式检测和高级压缩选项。

支持格式

  • 输出格式:JPEG、PNG、WEBP、BMP、TIFF
  • 输入格式:自动检测所有常见图像格式

特点

  • 批量处理:支持文件夹批量转换,自动创建输出目录
  • 质量控制:1-100可调质量参数,精确控制文件大小和画质
  • 高级选项:支持优化压缩、渐进式编码、无损压缩
  • 智能检测:基于文件内容而非扩展名的格式检测
  • 详细报告:提供转换过程的详细信息和统计数据

批量图像加载器
BatchLoadingOfImages

从指定目录批量加载图像文件,支持多种排序方式和加载控制。

特点

  • 批量加载:从文件夹批量加载图像,支持JPG、PNG、WEBP、JXL等格式
  • 多种排序:支持按字母、数字、日期时间等升序/降序排列
  • 加载控制:支持设置起始索引和加载数量限制
  • 实时刷新:支持始终重新加载模式,实时获取最新文件

🎞️ 电影后期处理类节点

节点名称功能描述
胶片颗粒效果
FilmGrain

为图像添加逼真的胶片颗粒效果,营造经典胶片质感。

  • 双分布模式:支持高斯分布(自然胶片噪点)和平均分布(数字均匀噪点)
  • 饱和度混合:独立控制彩色/单色颗粒比例,实现从彩色胶片到黑白胶片的平滑过渡

拉普拉斯锐化
LaplacianSharpen
基于拉普拉斯算子的边缘锐化工具,通过二阶微分检测图像边缘并增强细节,适合风景和人像的细节增强。
索贝尔锐化
SobelSharpen
采用索贝尔算子的方向性锐化工具,通过梯度计算同时增强水平和垂直边缘,适合需要强调纹理的场景。
USM锐化
USMSharpen
使用经典USM锐化技术来增强细节,对目标图像进行自然的锐化处理。
色彩匹配
ColorMatchToReference
智能色彩匹配工具,可将参考图像的色调风格应用到目标图像,实现专业级色彩统一。

🎬 视频处理类节点

节点名称功能描述
视频帧提取器
VideoFrameExtractor
专业的视频帧提取工具,支持从视频文件中提取指定数量的帧或按间隔提取帧,适用于视频分析、预览和后续处理。

特点

  • 双提取模式:支持按数量提取(均匀分布)和按间隔提取两种模式
  • 可选保存:支持将提取的帧保存到指定目录

🎵 音乐相关节点

节点名称功能描述
Suno歌词生成器
SunoLyricsGenerator
专业的AI歌词创作工具,基于在线LLM生成结构化的可演唱歌词,支持多种音乐风格和语言。
Suno歌曲风格提示词生成器
SunoSongStylePromptGenerator
专业的歌曲风格提示词生成工具,结合用户偏好和音乐元素,生成结构化的Suno风格提示词,用于快速构建风格一致的歌曲。
音频时长计算器
AudioDuration
计算音频文件的时长信息,输出秒数、格式化时间和毫秒数三种格式。

特点

  • 多格式输出:同时输出秒数、格式化时间(HH:MM:SS.mmm)和毫秒数
  • 自动适配:自动适配不同维度的音频张量
  • 精确计算:基于采样率进行精确时长计算

🤖 AI视觉理解节点

节点名称功能描述
Qwen3-VL基础版
Qwen3VLBasic
基于阿里巴巴Qwen3-VL模型的基础视觉理解节点,提供简洁高效的图像和视频分析功能,支持多种模型版本和量化选项,为Qwen3-VL高级版简化而来的版本。
Qwen3-VL高级版
Qwen3VLAdvanced
基于阿里巴巴Qwen3-VL模型的专业级视觉理解节点,集成众多预设提示词模板,支持智能批量处理、高级量化技术和思维链推理功能。提供从标签生成到创意分析的多种预设模式,具备解锁限制、多语言输出、批量处理等高级特性。

参数详解文档Qwen3VL_Parameters_Guide.md


Qwen3-VL在线版
Qwen3VLAPI
功能强大的云端视觉理解节点,支持多平台在线API调用和批量图像分析,提供丰富的模型选择和灵活的配置方式。

支持平台

  • 硅基流动平台、魔搭社区平台、自定义API

核心特点

  • 云端部署:无需本地GPU,通过API调用云端模型
  • 双重配置模式:平台预设和完全自定义两种模式
  • 批量处理:支持文件夹批量处理,自动保存结果

Qwen3-VL额外选项
Qwen3VLExtraOptions
为Qwen3-VL节点提供详细的输出控制选项,包括人物信息、光照分析、相机角度、水印检测等高级配置参数。
Qwen3-VL图像加载器
ImageLoader
专为Qwen3-VL优化的图像加载节点,支持多种图像格式和批量加载功能。
Qwen3-VL视频加载器
VideoLoader
专为Qwen3-VL优化的视频加载节点,支持多种视频格式和帧提取功能。
Qwen3-VL多路径输入
MultiplePathsInput
支持同时处理多个文件路径的输入节点,便于批量处理图像和视频文件。
Qwen3-VL路径切换器
PathSwitch
双通道路径切换器,支持手动和自动两种切换模式。可在2个来自MultiplePathsInput节点的路径输入之间智能切换,支持注释标签便于管理。手动模式下可指定选择通道,自动模式下智能选择第一个非空输入,适用于工作流中的条件分支和动态切换。输出可直接连接到Qwen3-VL高级版的source_path输入。
Florence2 Plus
Florence2Plus
基于微软Florence-2视觉理解模型的专业图像分析节点,支持多种任务类型和批量处理功能。

核心特性

  • 多模型支持:支持Microsoft Florence-2基础和大型模型,以及MiaoshouAI PromptGen系列
  • 丰富任务类型:支持标题生成、详细描述、标签生成、混合模式、分析模式等7种任务
  • 批量处理:支持单张图片、多张图片和整个文件夹的批量处理
  • 性能优化:支持fp16/bf16/fp32精度,flash_attention_2/sdpa/eager注意力机制
  • 智能内存管理:提供卸载到CPU、完全卸载、保持加载三种内存管理模式

使用建议

  • 基础任务使用Microsoft模型,复杂任务使用MiaoshouAI PromptGen模型
  • 显存充足时使用bf16获得最佳质量,有限时使用fp16平衡性能
  • 根据使用频率选择合适的内存管理模式

Sa2VA高级版
Sa2VAAdvanced
基于字节跳动Sa2VA模型的专业级图像分割节点,提供精确的智能分割功能,支持多种模型版本和量化配置。通过自然语言提示词控制分割区域,实现对图像中特定对象的精准分割,输出高质量的遮罩数据。

核心功能

  • 智能分割:基于自然语言提示词进行精确的图像对象分割
  • 多模型支持:支持多种Sa2VA模型版本,包括InternVL3和Qwen系列
  • 量化优化:提供4bit和8bit量化选项,优化性能和资源使用
  • Flash Attention:支持Flash Attention技术,提升推理效率
  • 模型管理:内置模型下载和管理功能,支持本地缓存
Sa2VA分割预设
Sa2VASegmentationPreset
提供交互式分割预设选择的工具节点,可在界面中选择常见部位/对象并生成中文分割提示文本输出,用于驱动 Sa2VA 高级版的分割。将本节点的 segmentation_preset 输出连接到 Sa2VA 高级版的同名输入即可生效。若该输入为空,Sa2VA 高级版将改用字符串输入框中的 segmentation_prompt
LM Studio节点
LMStudioNode
连接本地LM Studio服务器的视觉理解节点,支持图像分析和文本生成。通过LM Studio本地部署的大模型,实现无需云端API的私有化图像分析。

前置要求

  • 需要安装 LM Studio 软件,下载地址:https://lmstudio.ai
  • 在LM Studio中下载并加载支持视觉能力的模型(如Qwen2-VL、Llama-Vision等)
  • 启动LM Studio的本地服务器功能(默认端口1234)

核心功能

  • 本地部署:连接本地LM Studio服务器,无需云端API密钥
  • 多种预设模板:支持标签反推、详细描述、创意写作等多种提示词预设
  • 输出语言控制:支持中文、英文、中英双语等多种输出语言
  • 模型自动发现:自动获取LM Studio中已加载的模型列表
  • 模型刷新:一键刷新按钮,当模型列表显示异常时可重新获取
  • 多图像输入:支持最多4张图像同时输入进行单轮推理
  • 推理日志面板:实时显示推理日志,仅显示当前运行信息
  • 可视化设置:提供状态设置界面,方便配置参数

配套节点

  • LM Studio模型卸载:一键卸载LM Studio中已加载的模型,释放显存

⚙️ 逻辑与工具类节点

节点名称功能描述
🏷️TAG标签选择器
TagSelector

新一代智能标签管理系统,集成海量预设标签库、自定义标签功能、角色提取器和内置AI扩写能力,提供前所未有的标签选择体验,快速构建复杂提示词,提升创作效率。

核心功能

  • 标签分类丰富:涵盖常规标签、艺术题材、人物属性、场景环境等全方位分类
  • 自定义标签管理:支持添加、编辑、删除个人专属标签,打造个性化标签库
  • 智能搜索定位:支持关键词搜索,快速找到目标标签
  • 实时选择统计:动态显示已选标签数量和详细列表
  • 随机标签生成:智能随机标签生成功能,支持按分类权重和数量配置自动生成多样化标签组合
  • 角色提取器:从远程服务器获取角色数据,自动生成AI绘图提示词,支持历史记录管理
  • 内置AI扩写:一键智能扩写功能,支持标签式和自然语言式两种扩写模式

参数说明

  • tag_edit:手动编辑的标签文本,支持直接输入或粘贴
  • random_logic:随机逻辑选择(Disabled/Random Tags/Character Extractor)
    • Disabled:禁用随机功能
    • Random Tags:使用随机标签界面中配置的规则生成标签
    • Character Extractor:使用角色提取器功能获取标签
  • expand_mode:扩写模式选择(Disabled/Tag Style/Natural Language/Structured JSON)
  • output_language:扩写结果语言(Chinese/English)
  • platform:API平台选择(auto自动选择可用平台)
  • max_tokens:AI生成内容的最大令牌数

Latent切换器(双模式)
LatentSwitchDualMode
支持可变数量的潜变量输入的双模式切换器。通过滑块 inputcount 控制端口数量,并点击按钮 Update inputs 同步增删端口;手动模式下按索引选择输出(select_channel 选项随 inputcount 自动更新);自动模式仅在存在唯一非空输入时输出,检测到多个非空输入将提示错误。新增的潜变量输入端口均为非必连,适合在不同生成路径之间灵活切换与对比实验。
文本切换器(双模式)
TextSwitchDualMode
支持可变数量的文本输入的双模式切换器。通过滑块 inputcount 控制端口数量,并点击按钮 Update inputs 同步增删端口;手动模式下按索引选择输出(select_text 选项随 inputcount 自动更新);自动模式仅在存在唯一非空输入时输出,检测到多个非空输入将提示错误。新增的文本输入端口均为非必连,适合在不同版本提示词之间灵活切换与对比实验。
图像切换器(双模式)
ImageSwitchDualMode
支持可变数量的图像输入的双模式切换器。通过滑块 inputcount 控制端口数量,并点击按钮 Update inputs 同步增删端口;手动模式下按索引选择输出(select_image 选项随 inputcount 自动更新);自动模式仅在存在唯一非空输入时输出,检测到多个非空输入将提示错误。新增的图像输入端口均为非必连,便于在不同生成结果或不同处理路径之间进行灵活对比。
优先级图像切换
PriorityImageSwitch
智能优先级图像切换节点,当同时接入图像A和图像B端口时,优先输出B端口的内容;如果B端口无输入,则输出图像A端口的内容;如果两个端口都无输入,则弹出提示要求至少连接一个输入端口。

特点

  • 优先级控制:图像B端口优先级高于图像A端口
  • 智能切换:自动检测输入状态,无缝切换输出,减少手动切换操作

多平台翻译
MultiPlatformTranslate

多平台翻译节点,支持百度、阿里云、有道、智谱AI和免费翻译服务。用户可以通过配置管理界面设置各平台的API密钥,实现高质量的专业翻译服务。

特点

  • 多平台支持:支持主流翻译平台,满足不同需求
  • 配置管理:通过图形化界面轻松管理各平台API密钥
  • 专业翻译:提供高质量的专业翻译服务
资源清理器
ResourceCleaner

系统资源清理工具,提供独立的内存(RAM)、显存(VRAM)和缓存清理控制,可选择性释放系统资源。

特点

  • 独立控制:三个清理功能配备独立开关,可单独或组合使用
  • 详细报告:输出清理过程的详细报告,便于监控资源释放情况
工作流暂停器
PauseWorkflow

智能工作流控制节点,可在任意位置暂停工作流执行,等待用户交互后继续或取消执行。

特点

  • 通用输入:支持任意类型的数据输入和输出,可插入工作流的任何位置
  • 交互式控制:提供继续和取消两个操作选项
  • 状态管理:智能管理每个节点实例的暂停状态
  • 异常处理:取消时抛出中断异常,安全终止工作流
预留显存设置器
ReservedVRAMSetter

专业的GPU显存预留管理工具,用于控制ComfyUI的显存使用策略,有效防止显存溢出(OOM)错误,提升工作流稳定性。支持手动和自动两种模式,自动模式可根据当前GPU使用情况智能计算合适的预留显存量。

特点

  • 双模式支持:手动模式固定设置预留显存量,自动模式根据当前GPU使用情况智能调整
  • 智能清理:支持在设置前自动清理GPU显存,释放无用资源
  • 自动限制:自动模式下可设置最大预留上限,防止过度预留影响其他应用
  • 种子控制:内置随机种子管理,确保工作流的一致性

预留显存设置器
整数节点
IntNode

输出可配置整数值的工具节点,用于统一的参数控制。支持-2147483648到2147483647范围的整数输入,适用于需要精确数值控制的场景。


整数节点
组开关管理器
GroupSwitchManager

可视化群组开关管理工具,自动检测工作流中的所有群组,提供一键启用/禁用功能,支持颜色过滤、标题匹配、拖拽排序和群组联动配置。

核心功能

  • 智能过滤:支持按颜色或标题关键词筛选群组
  • 拖拽排序:自定义群组显示顺序
  • 联动配置:配置群组间的联动规则,实现开关联动效果
  • 快速导航:点击箭头快速定位到对应群组位置
  • 双模式支持:支持禁用模式和忽略模式


🚀 安装方式

📦 方式一:通过 ComfyUI Manager 安装(推荐)

  1. 安装 ComfyUI Manager
  2. 在 Manager 菜单中选择 "Install Custom Nodes"
  3. 搜索 zhihui_nodes_comfyui 并点击 "Install" 按钮
  4. 等待安装完成后重启 ComfyUI,即可在节点菜单中找到新添加的节点

🔧 方式二:通过 Git 安装

进入 ComfyUI 的 custom_nodes 目录,执行以下命令:

git clone https://github.com/ZhiHui6/zhihui_nodes_comfyui.git

重启 ComfyUI 即可使用。

📁 方式三:手动安装

  1. 下载本仓库的 ZIP 文件并解压
  2. 将整个 zhihui_nodes_comfyui 文件夹复制到 ComfyUI 的 custom_nodes 目录下
  3. 重启 ComfyUI

📋 依赖项

本节点集大部分功能无需额外依赖,开箱即用。部分在线功能(如翻译、提示词优化)需要网络连接。

如需手动安装依赖,可执行:

pip install -r requirements.txt

🤝 贡献指南

我们欢迎各种形式的贡献,包括但不限于:

[🔴报告问题和提出建议 ] | [💡提交功能请求] | [📚改进文档] | [💻提交代码贡献]

如果您有任何想法或建议,请随时提出 Issue 或 Pull Request。

Contributors

ZhiHui6

337 commits

Languages

JavaScript

70.2%

Python

29.5%