license: Apache License 2.0 domain: multi-modal tags:
本项目是基于 Stable Diffusion WebUI Forge 的中文改良版本,专注于优化和多模态插件融合,目标是通过简单易用的 GUI 运行最新的流行模型。
[!NOTE] 本版本为改良版本,部分插件直接安装会发生兼容性错误,为了适应众多新旧插件做了些许修改。
本次更新全面支持 API 云端模型,无需本地部署大模型即可使用最新图像生成与编辑能力,大幅降低显存门槛。
| 供应商 | 官网 | 说明 |
|---|---|---|
| ModelScope 魔搭 | modelscope.cn | 阿里云开源模型社区,提供丰富的图像生成 API |
| DashScope 通义千问 | dashscope.aliyun.com | 阿里云大模型服务,支持 Qwen-Image 文生图与图像编辑 |
| PixAPI | pixapi.ai | 聚合 GPT-Image、Gemini 等多模型的统一 API 平台 |
| 模型名称 | 供应商 | 类型 | 说明 |
|---|---|---|---|
| 🍌 香蕉模型 (Banana) | ModelScope | 文生图 / 图像编辑 | 高质量图像生成与编辑模型 |
| MiniMax H3 | ModelScope | 视频生成 | 文生视频 / 图生视频 |
| GPT-Image 2 | PixAPI | 文生图 / 编辑 | OpenAI 最新图像模型 |
| Qwen-Image-Edit-2511 (满血版) | ModelScope | 图像编辑 | 满血版本图像编辑模型 |
| FireRed-Image-Edit-1.1 (满血版) | ModelScope | 图像编辑 | 满血版本图像编辑模型 |
| Krea-2-Turbo (满血版) | ModelScope | 文生图 | 高速实时满血图像生成 |
[!TIP] API Key 可在各供应商官网的控制台中创建。API 模式与本地模型模式可自由切换。
部署区涵盖从零开始部署本项目所需的所有信息,包括系统要求、安装步骤、启动器使用和常见问题。
| 项目 | 最低要求 | 推荐配置 |
|---|---|---|
| 操作系统 | Windows 10/11 (64位) | Windows 11 |
| Python | 3.13.12 | 3.13.12 |
| GPU | NVIDIA GPU 4GB+ 显存 | NVIDIA GPU 12GB+ 显存 |
| 内存 | 16GB | 32GB |
| 磁盘空间 | 50GB 可用空间 | 100GB+ SSD |
python --version 验证git clone https://github.com/exo101/sd-webui-forge-neo-v3.git
cd sd-webui-forge-neo-v3
或直接下载 ZIP 解压到任意目录(路径不要包含中文和空格)。
方式一:使用智能启动器(推荐)
启动器.exe方式二:使用批处理文件
webui 目录,双击运行 webui-user.bathttp://127.0.0.1:7860[!NOTE] 首次启动需要 5-15 分钟安装依赖,请保持网络畅通,不要关闭窗口。
启动器采用 PyQt6 开发,提供以下功能模块:
| 功能 | 说明 |
|---|---|
| ⚡ 启动/停止 | 一键启动或停止 WebUI |
| 🌐 页面 | 打开 WebUI 的浏览器界面 |
| 🔄 检查更新 | 自动检测 GitHub 最新版本 |
| 🛑 全部停止 | 强制停止所有相关进程 |
| 标签页 | 功能 |
|---|---|
| 环境检测 | GPU 型号、显存大小、驱动版本、系统资源 |
| 模型管理 | 模型目录结构说明、下载指南 |
| 扩展管理 | 已安装扩展列表、启用/禁用 |
| 参数设置 | 代理配置、启动参数、性能选项 |
| 运行日志 | 实时日志输出、错误诊断 |
| 问题 | 解答 |
|---|---|
| 启动器显示"环境检测失败"? | 检查是否安装了 Python 3.13.12 并勾选了 "Add Python to PATH",重启电脑后重试 |
| 首次启动卡在"安装依赖"? | 首次安装需要 10-30 分钟,请检查网络连接,可在启动器中配置代理 |
| 浏览器显示"无法访问此网站"? | 检查启动器日志,确认端口 7860 未被占用,或点击启动器"页面"按钮手动打开 |
| 生成图片时提示"显存不足"? | 启用"显存防溢出保护",降低分辨率,使用 FP8 量化模型,或切换 API 云端模式 |
| 生成的图片全黑或质量差? | 确认选择了正确的模型,检查提示词,尝试换采样器(如 Euler a),增加采样步数 |
| 如何更新到最新版本? | 在启动器主控台点击"检查启动器更新",或重新 git pull |
内核区介绍本项目基于 Forge 框架所做的底层优化,包括性能加速、显存优化和功能增强。
| 优化项 | 说明 |
|---|---|
| SageAttention | 新一代注意力优化,显存占用极低 |
| FlashAttention | 高速注意力计算 |
| xFormers | 内存高效的注意力实现 |
| Triton 内核 | int8 矩阵乘法加速 |
torch.compile 加速推理| 显存大小 | 推荐配置 | 支持模型 |
|---|---|---|
| 4-6 GB | TAESD + 分块处理 | SD1.5, SD2.1 |
| 8 GB | 默认配置 | SDXL, Flux.2-Klein 4B |
| 12 GB | 全功能 | Flux, Anima, Qwen-Image |
| 16 GB+ | 无限制 | Wan 2.2, Flux.2-Klein 9B |
模型区介绍本项目支持的各类模型及其文件结构,助你快速了解如何下载和配置模型。
webui/models/
├── Stable-diffusion/ # 所有主模型(SD1.5、SDXL、Flux、Anima、Qwen-Image、Wan 等)
├── Lora/ # LoRA 微调模型
├── VAE/ # 变分自编码器
├── text_encoder/ # 文本编码器 ⚠️ 需手动下载
├── CLIP/ # CLIP 文本编码器
├── ControlNet/ # ControlNet 控制网络
├── ControlNetPreprocessor/ # ControlNet 预处理器
├── ESRGAN/ # 超分辨率放大模型
└── RealESRGAN/ # 超分辨率模型
传统模型,只需一个 checkpoint 文件即可运行:
models/Stable-diffusion/
└── your_model.safetensors # 包含 UNet + VAE + 文本编码器
Flux 采用 DiT 架构,组件分离存储:
models/Stable-diffusion/
└── flux1-dev-fp8.safetensors
models/text_encoder/ # T5 编码器(必需,约 4.7GB)
└── t5xxl_fp8_e4m3fn.safetensors
models/clip/ # CLIP 编码器(必需,约 235MB)
└── clip_l.safetensors
多模态编辑模型,支持图像编辑与生成:
models/Stable-diffusion/
└── flux-2-klein-9b-fp8.safetensors
models/text_encoder/
└── qwen_3_4b.safetensors
models/vae/
└── flux2-vae.safetensors
二次元高质量专用模型:
models/Stable-diffusion/
└── anima.safetensors
models/text_encoder/
└── qwen_3_06b_base.safetensors
models/VAE/
└── qwen_image_vae.safetensors
通义千问图像生成/编辑模型:
models/Stable-diffusion/
└── qwen_image_edit_2511_int8_convrot.safetensors
models/text_encoder/
└── qwen_2.5_vl_7b_fp8_scaled.safetensors
models/VAE/
└── qwen_image_vae.safetensors
视频生成模型:
models/Stable-diffusion/
├── wan2.2_t2v_high_noise_14B_fp8_scaled.safetensors
└── wan2.2_t2v_low_noise_14B_fp8_scaled.safetensors
models/text_encoder/
├── umt5-xx-fp8-scaled.safetensors
└── umt5-xxl-enc-bf16.safetensors
models/VAE/
└── wan_2.2_vae.safetensors
[!TIP] 导出视频需要安装 FFmpeg
| 模型 | 下载方式 | 说明 |
|---|---|---|
| SD1.5 / SDXL | Civitai Helper 插件一键下载 | Stable-diffusion |
| LoRA | Civitai Helper 插件一键下载 | 风格/角色微调 |
| ControlNet | Civitai Helper 插件一键下载 | 控制网络 |
| Flux CLIP | HuggingFace 手动下载 | 放入 models/clip/ |
| Flux T5 | HuggingFace 手动下载 | 放入 models/text_encoder/ |
插件区介绍本项目已集成和优化的各类扩展插件,按功能分类展示。
| 插件名称 | 功能说明 |
|---|---|
| 🎨 美学提升 | Qwen3.5 图像与视频美学质量分析 |
| 📷 相机角度选择器 | 3D 可视化多角度提示词选择,支持方位角、高程角、距离调整 |
| 🎥 多媒体处理 | Qwen3-TTS 语音合成、唇形同步多媒体处理 |
| 👁️ 图像识别与对话 | 基于 Qwen3.5 视觉模型的图像识别与对话功能 |
| ✂️ 图像分割与抠图 | SAM 模型一键抠图、背景替换、图像清理 |
| 🔍 图层分离 | 动漫风格图像的图层分解与透明化处理,支持深度估计和3D效果生成 |
| 🌄 无边图像浏览 | 快速浏览和管理历史生成图片 |
| 🖼️ 图像对比 | 并排对比两张生成图片的差异 |
| 插件名称 | 优化说明 |
|---|---|
| 🔧 ADetailer | 兼容性优化,模型懒加载(首次使用时下载),修复人脸修复问题 |
| 🔧 Photoshop 插件 | Auto-Photoshop-StableDiffusion-Plugin 增强 |
| 🏷️ WD 1.4 标签器 | 自动生成图像标签,支持中文 |
| 🌐 Civitai Helper | 模型下载与管理,支持一键下载、元数据同步、批量操作 |
| 🎯 LoRA Prompt Tool | LoRA 提示词智能推荐与权重调节 |
| 🔄 区域提示词 | 图像分区控制,不同区域使用不同提示词 |
| 📦 SuperMerger | 模型合并与融合工具 |
| 🔤 标签补全 | 提示词自动补全,提高输入效率 |
| 🇨🇳 中文界面 | 完全汉化的界面语言包 |
| 功能名称 | 说明 |
|---|---|
| 🛡️ 显存防溢出保护 | 防止显存溢出导致的崩溃,支持 UNet/VAE 分块处理 |
| 🖼️ 多图拼接参考 | 多图像拼接与参考功能 |
| 🌱 种子多样性增强 | 改善蒸馏模型的种子多样性 |
| ⚡ 频谱预测加速 | 免训练加速所有模型 |
| 🔥 PyTorch 编译加速 | 使用 torch.compile 加速推理 |
| 🎛️ 调制引导控制 | 改善 Anima 模型的生成质量 |
扫码加入 AI 交流群,获取最新整合包、使用技巧和问题解答。
关注 哔哩哔哩(鸡肉爱土豆) 获取最新教程和更新通知。
本项目遵循 AGPL-3.0 许可证。详情请参阅 LICENSE 文件。
[!NOTE] 此版本整合包通过秋叶aaaki、张吕敏、Haoming02 等多位大佬技术总结做出的版本,不属于任何个人、企业,是非盈利性质的开源软件。
⭐ 如果这个项目对您有帮助,请给个 Star 支持一下!⭐
Made with ❤️ by exo101
Python
79.8%
Jupyter Notebook
6.3%
JavaScript
3.8%
Vue
2.1%
CSS
1.4%
Less
1.2%
Cuda
1.2%
C++
1.1%
Shell
1.1%
license: Apache License 2.0 domain: multi-modal tags:
本项目是基于 Stable Diffusion WebUI Forge 的中文改良版本,专注于优化和多模态插件融合,目标是通过简单易用的 GUI 运行最新的流行模型。
[!NOTE] 本版本为改良版本,部分插件直接安装会发生兼容性错误,为了适应众多新旧插件做了些许修改。
本次更新全面支持 API 云端模型,无需本地部署大模型即可使用最新图像生成与编辑能力,大幅降低显存门槛。
| 供应商 | 官网 | 说明 |
|---|---|---|
| ModelScope 魔搭 | modelscope.cn | 阿里云开源模型社区,提供丰富的图像生成 API |
| DashScope 通义千问 | dashscope.aliyun.com | 阿里云大模型服务,支持 Qwen-Image 文生图与图像编辑 |
| PixAPI | pixapi.ai | 聚合 GPT-Image、Gemini 等多模型的统一 API 平台 |
| 模型名称 | 供应商 | 类型 | 说明 |
|---|---|---|---|
| 🍌 香蕉模型 (Banana) | ModelScope | 文生图 / 图像编辑 | 高质量图像生成与编辑模型 |
| MiniMax H3 | ModelScope | 视频生成 | 文生视频 / 图生视频 |
| GPT-Image 2 | PixAPI | 文生图 / 编辑 | OpenAI 最新图像模型 |
| Qwen-Image-Edit-2511 (满血版) | ModelScope | 图像编辑 | 满血版本图像编辑模型 |
| FireRed-Image-Edit-1.1 (满血版) | ModelScope | 图像编辑 | 满血版本图像编辑模型 |
| Krea-2-Turbo (满血版) | ModelScope | 文生图 | 高速实时满血图像生成 |
[!TIP] API Key 可在各供应商官网的控制台中创建。API 模式与本地模型模式可自由切换。
部署区涵盖从零开始部署本项目所需的所有信息,包括系统要求、安装步骤、启动器使用和常见问题。
| 项目 | 最低要求 | 推荐配置 |
|---|---|---|
| 操作系统 | Windows 10/11 (64位) | Windows 11 |
| Python | 3.13.12 | 3.13.12 |
| GPU | NVIDIA GPU 4GB+ 显存 | NVIDIA GPU 12GB+ 显存 |
| 内存 | 16GB | 32GB |
| 磁盘空间 | 50GB 可用空间 | 100GB+ SSD |
python --version 验证git clone https://github.com/exo101/sd-webui-forge-neo-v3.git
cd sd-webui-forge-neo-v3
或直接下载 ZIP 解压到任意目录(路径不要包含中文和空格)。
方式一:使用智能启动器(推荐)
启动器.exe方式二:使用批处理文件
webui 目录,双击运行 webui-user.bathttp://127.0.0.1:7860[!NOTE] 首次启动需要 5-15 分钟安装依赖,请保持网络畅通,不要关闭窗口。
启动器采用 PyQt6 开发,提供以下功能模块:
| 功能 | 说明 |
|---|---|
| ⚡ 启动/停止 | 一键启动或停止 WebUI |
| 🌐 页面 | 打开 WebUI 的浏览器界面 |
| 🔄 检查更新 | 自动检测 GitHub 最新版本 |
| 🛑 全部停止 | 强制停止所有相关进程 |
| 标签页 | 功能 |
|---|---|
| 环境检测 | GPU 型号、显存大小、驱动版本、系统资源 |
| 模型管理 | 模型目录结构说明、下载指南 |
| 扩展管理 | 已安装扩展列表、启用/禁用 |
| 参数设置 | 代理配置、启动参数、性能选项 |
| 运行日志 | 实时日志输出、错误诊断 |
| 问题 | 解答 |
|---|---|
| 启动器显示"环境检测失败"? | 检查是否安装了 Python 3.13.12 并勾选了 "Add Python to PATH",重启电脑后重试 |
| 首次启动卡在"安装依赖"? | 首次安装需要 10-30 分钟,请检查网络连接,可在启动器中配置代理 |
| 浏览器显示"无法访问此网站"? | 检查启动器日志,确认端口 7860 未被占用,或点击启动器"页面"按钮手动打开 |
| 生成图片时提示"显存不足"? | 启用"显存防溢出保护",降低分辨率,使用 FP8 量化模型,或切换 API 云端模式 |
| 生成的图片全黑或质量差? | 确认选择了正确的模型,检查提示词,尝试换采样器(如 Euler a),增加采样步数 |
| 如何更新到最新版本? | 在启动器主控台点击"检查启动器更新",或重新 git pull |
内核区介绍本项目基于 Forge 框架所做的底层优化,包括性能加速、显存优化和功能增强。
| 优化项 | 说明 |
|---|---|
| SageAttention | 新一代注意力优化,显存占用极低 |
| FlashAttention | 高速注意力计算 |
| xFormers | 内存高效的注意力实现 |
| Triton 内核 | int8 矩阵乘法加速 |
torch.compile 加速推理| 显存大小 | 推荐配置 | 支持模型 |
|---|---|---|
| 4-6 GB | TAESD + 分块处理 | SD1.5, SD2.1 |
| 8 GB | 默认配置 | SDXL, Flux.2-Klein 4B |
| 12 GB | 全功能 | Flux, Anima, Qwen-Image |
| 16 GB+ | 无限制 | Wan 2.2, Flux.2-Klein 9B |
模型区介绍本项目支持的各类模型及其文件结构,助你快速了解如何下载和配置模型。
webui/models/
├── Stable-diffusion/ # 所有主模型(SD1.5、SDXL、Flux、Anima、Qwen-Image、Wan 等)
├── Lora/ # LoRA 微调模型
├── VAE/ # 变分自编码器
├── text_encoder/ # 文本编码器 ⚠️ 需手动下载
├── CLIP/ # CLIP 文本编码器
├── ControlNet/ # ControlNet 控制网络
├── ControlNetPreprocessor/ # ControlNet 预处理器
├── ESRGAN/ # 超分辨率放大模型
└── RealESRGAN/ # 超分辨率模型
传统模型,只需一个 checkpoint 文件即可运行:
models/Stable-diffusion/
└── your_model.safetensors # 包含 UNet + VAE + 文本编码器
Flux 采用 DiT 架构,组件分离存储:
models/Stable-diffusion/
└── flux1-dev-fp8.safetensors
models/text_encoder/ # T5 编码器(必需,约 4.7GB)
└── t5xxl_fp8_e4m3fn.safetensors
models/clip/ # CLIP 编码器(必需,约 235MB)
└── clip_l.safetensors
多模态编辑模型,支持图像编辑与生成:
models/Stable-diffusion/
└── flux-2-klein-9b-fp8.safetensors
models/text_encoder/
└── qwen_3_4b.safetensors
models/vae/
└── flux2-vae.safetensors
二次元高质量专用模型:
models/Stable-diffusion/
└── anima.safetensors
models/text_encoder/
└── qwen_3_06b_base.safetensors
models/VAE/
└── qwen_image_vae.safetensors
通义千问图像生成/编辑模型:
models/Stable-diffusion/
└── qwen_image_edit_2511_int8_convrot.safetensors
models/text_encoder/
└── qwen_2.5_vl_7b_fp8_scaled.safetensors
models/VAE/
└── qwen_image_vae.safetensors
视频生成模型:
models/Stable-diffusion/
├── wan2.2_t2v_high_noise_14B_fp8_scaled.safetensors
└── wan2.2_t2v_low_noise_14B_fp8_scaled.safetensors
models/text_encoder/
├── umt5-xx-fp8-scaled.safetensors
└── umt5-xxl-enc-bf16.safetensors
models/VAE/
└── wan_2.2_vae.safetensors
[!TIP] 导出视频需要安装 FFmpeg
| 模型 | 下载方式 | 说明 |
|---|---|---|
| SD1.5 / SDXL | Civitai Helper 插件一键下载 | Stable-diffusion |
| LoRA | Civitai Helper 插件一键下载 | 风格/角色微调 |
| ControlNet | Civitai Helper 插件一键下载 | 控制网络 |
| Flux CLIP | HuggingFace 手动下载 | 放入 models/clip/ |
| Flux T5 | HuggingFace 手动下载 | 放入 models/text_encoder/ |
插件区介绍本项目已集成和优化的各类扩展插件,按功能分类展示。
| 插件名称 | 功能说明 |
|---|---|
| 🎨 美学提升 | Qwen3.5 图像与视频美学质量分析 |
| 📷 相机角度选择器 | 3D 可视化多角度提示词选择,支持方位角、高程角、距离调整 |
| 🎥 多媒体处理 | Qwen3-TTS 语音合成、唇形同步多媒体处理 |
| 👁️ 图像识别与对话 | 基于 Qwen3.5 视觉模型的图像识别与对话功能 |
| ✂️ 图像分割与抠图 | SAM 模型一键抠图、背景替换、图像清理 |
| 🔍 图层分离 | 动漫风格图像的图层分解与透明化处理,支持深度估计和3D效果生成 |
| 🌄 无边图像浏览 | 快速浏览和管理历史生成图片 |
| 🖼️ 图像对比 | 并排对比两张生成图片的差异 |
| 插件名称 | 优化说明 |
|---|---|
| 🔧 ADetailer | 兼容性优化,模型懒加载(首次使用时下载),修复人脸修复问题 |
| 🔧 Photoshop 插件 | Auto-Photoshop-StableDiffusion-Plugin 增强 |
| 🏷️ WD 1.4 标签器 | 自动生成图像标签,支持中文 |
| 🌐 Civitai Helper | 模型下载与管理,支持一键下载、元数据同步、批量操作 |
| 🎯 LoRA Prompt Tool | LoRA 提示词智能推荐与权重调节 |
| 🔄 区域提示词 | 图像分区控制,不同区域使用不同提示词 |
| 📦 SuperMerger | 模型合并与融合工具 |
| 🔤 标签补全 | 提示词自动补全,提高输入效率 |
| 🇨🇳 中文界面 | 完全汉化的界面语言包 |
| 功能名称 | 说明 |
|---|---|
| 🛡️ 显存防溢出保护 | 防止显存溢出导致的崩溃,支持 UNet/VAE 分块处理 |
| 🖼️ 多图拼接参考 | 多图像拼接与参考功能 |
| 🌱 种子多样性增强 | 改善蒸馏模型的种子多样性 |
| ⚡ 频谱预测加速 | 免训练加速所有模型 |
| 🔥 PyTorch 编译加速 | 使用 torch.compile 加速推理 |
| 🎛️ 调制引导控制 | 改善 Anima 模型的生成质量 |
扫码加入 AI 交流群,获取最新整合包、使用技巧和问题解答。
关注 哔哩哔哩(鸡肉爱土豆) 获取最新教程和更新通知。
本项目遵循 AGPL-3.0 许可证。详情请参阅 LICENSE 文件。
[!NOTE] 此版本整合包通过秋叶aaaki、张吕敏、Haoming02 等多位大佬技术总结做出的版本,不属于任何个人、企业,是非盈利性质的开源软件。
⭐ 如果这个项目对您有帮助,请给个 Star 支持一下!⭐
Made with ❤️ by exo101
Python
79.8%
Jupyter Notebook
6.3%
JavaScript
3.8%
Vue
2.1%
CSS
1.4%
Less
1.2%
Cuda
1.2%
C++
1.1%
Shell
1.1%