Windows tag editor for LoRA / character image datasets: booru tag editing with Chinese UI & translation, WD14/PixAI/CL ONNX auto-tagging, LLM captioning, AI character-tag audit (dual-character support), RMBG background removal, image editor, video frame extraction. Fork of starik222/BooruDatasetTagManager.
C#
18
29 commits
updated Oct 2, 2026
面向 LoRA / 角色数据集的 Windows 打标工具,fork 自 starik222/BooruDatasetTagManager。
每张图配一个同名 .txt 存放标签,加载文件夹就能改。也能用 LLM 或本地 Tag 推标(原名 ONNX 推标;引擎是 WD14 / PixAI / CL / OppaiOracle)自动打标,并做角色审查、用中文搜标签。界面默认简体中文。MIT License。

从 Releases 下载 BooruDatasetTagManagerPlus-*-win-x64.zip,解压后运行 BooruDatasetTagManagerPlus.exe(自包含,无需安装 .NET)。
.txt 的数据集);「重新导入当前数据集」(F5)随时从磁盘刷新当前目录BooruDatasetTagManagerPlus.exe help 列出全部命令(统计 / 批量改标 / 导出 / fix-tags 修复 / onnx-tag 推标 / audit 审查)dotnet build BooruDatasetTagManager.sln -c Debug -f net8.0-windows
dotnet test BooruDatasetTagManager.Tests\BooruDatasetTagManager.Tests.csproj
dotnet publish BooruDatasetTagManager\BooruDatasetTagManager.csproj -c Release -f net8.0-windows -r win-x64 --self-contained true -o dist
test_start.bat — 启动 Release(或 Debug)quick_build.bat — 本地快速打包至 dist/(首次构建自动下载 FFmpeg)运行后程序目录会生成 Models/(下载的 ONNX 模型)、Cache/(缓存)。settings.json(API 与偏好设置)保存在「文档\BooruDatasetTagManagerPlus」,换安装目录也能读到同一份;文档里还没有文件时会从程序目录整份复制,若文档里已是空配置而程序目录仍能识别到旧的 API(端点 / 密钥 / 站点配置),则只把这些 API 字段迁过去。均为本地自动生成数据,可随时删除——设置恢复默认,模型可在应用内重新下载。
| 类别 | 包含 |
|---|---|
| 打标 | LLM(标签 / 自然语言)· Tag 推标(本地 ONNX:WD14 / PixAI / CL / OppaiOracle)· 角色审查(最多 4 人) |
| 标签 | 中文搜索、类别着色与一二级筛选、错误标签修复、按标签筛图 |
| 图片 | 编辑器、批量裁剪、多重切割(含 YOLO)、预分桶、抠图 / 换透明底 |
| 整理 | 文件夹浏览与预览、按标签分文件夹、按分辨率分桶、相似图、坏图扫描、视频转换 / 抽帧 |
| 命令行 | 同一 exe:统计、批量改标、导出、Tag 推标(onnx-tag)、审查 |
数据集面板是一个统一浏览器:顶部搜索框同时过滤文件夹与文件名;kohya 重复文件夹显示为可折叠分组(多文件夹默认全部折叠,搜索框右侧有全部展开 / 全部折叠、平铺视图与排序按钮;平铺开启时忽略文件夹分组、把当前范围与筛选结果摊平为一列),点击文件夹名即可把数据集范围限定到该文件夹(全部标签计数、批量操作与审查向导同步跟随);图片行显示缩略图、文件名与「格式 · 像素 · 大小」,选择操作与文件管理器一致(Ctrl / Shift / Ctrl+A / 方向键 / 右键菜单 / Delete)。
.txt 同步改名);Tag 推标此文件夹 / LLM 打标此文件夹Data/danbooru_dataset_general.csv)带一二级分类,启动时加载;long_hair 与 long hair 都能对上。查不到的标签进「一般」Data/danbooru_character_tags.csv,含约 2.6 万条真实父子关系),角色标签精确识别着色,翻译显示为「译名 (作品)」;可在 设置 → 翻译 关闭。CSV 不含角色名,角色类仍靠这份表 / Danbooru 类型列
工具 是一段平铺下拉,用淡色底栏分成三类(标题不可点,混色方式与标签类别着色相同,浅色 / 深色主题都能看清):
错误标签修复仍在顶栏 测试功能 窗口;角色标签审查在标注工具和该窗口都能打开。
入口:工具 → LLM 打标…、数据集右键,或标签工具栏「自动生成标签」。使用前先在 LLM 设置 配置 OpenAI 兼容端点、文本 / 视觉模型与全局 LLM 并发(默认 5,范围 1–100)。


数据集目录_captioned/(源 .txt 只读、可跳过已有),也可就地写回原图 .txt入口:工具 → 角色标签审查…(测试功能 窗口里也有同一入口)。设定锁定触发词(强制保留)、标签方法(少标法只留核心特征 / 全标法保留全部正确细节)、最小出现次数与标准图后,AI 按角色最多发起 3 次请求:文本初筛、视觉复核,再对仍无颜色的穿戴标签与同槽位簇(如 bow / hair ribbon / hairband)做一次定向解析(流程不可回退,改参数请取消后重开)。最后逐条复核(保留 / 删除 / 替换 / 不确定):同簇标签加同色底纹,悬停列出簇成员;替换目标优先用词表内已有标签。预览最终角色提示词后,应用并保存为事务写盘、失败自动回滚。
支持多角色数据集(最多 4 人):主体模式选择 双人 或 多角色 后,为每个角色设定触发词、标准图与性别(留空的角色行自动跳过,因此三人数据集也适用);图片按触发词、再按文件夹自动归属,多人同图自动补齐 2girls、multiple girls 等主体数标签,AI 审查、逐条复核与应用均逐角色进行,某个角色失败时可只重试该角色(已完成角色的结果保留)。

原名 ONNX 推标。1.2.6 起界面统一为 Tag 推标(英文 Tag tagger):工具 → 标注工具 菜单、推标窗口标题、数据集右键 Tag 重新推标、文件夹右键 Tag 推标此文件夹…。引擎是本机 ONNX(WD14 / PixAI / CL / OppaiOracle),权重仍下到 Models/,命令行动词仍是 onnx-tag / onnx-models。
入口:工具 → Tag 推标…,或数据集右键 Tag 重新推标(自动开始);文件夹右键 Tag 推标此文件夹… 会预选「当前文件夹」来源,确认设置后再开始。

Models 目录入口:工具 → 快速替换…。左侧选规范词、设阈值,右侧预览将并入的同类低频标签,底栏左侧显示当前状态,确认后整库替换。同类按最后一个词判断(black shoes → shoes);出现次数低于阈值才会被换。
入口:工具 → 背景移除,或数据集右键 移除背景。内置 RMBG-1.4 ONNX 本地抠图,无需外部服务;首次使用一键下载模型(约 176 MB,或量化版约 44 MB,官方 / 镜像源)。

_nobg.png 副本(选项记忆);完成后自动刷新缩略图或导入副本入口:数据集右键 编辑图片。仿 Photoshop 布局:左侧紧凑工具箱、顶部选项栏、底部状态栏。

[/] 笔刷大小、Alt+点击 临时取色、滚轮以光标为中心缩放、Ctrl+0 适应窗口、Ctrl+1 100%、Ctrl+Z / Ctrl+Shift+Z / Ctrl+Y 撤销重做(整笔一步,最多 15 步)、Enter 应用裁切、Ctrl+S 保存_edit 副本(自动克隆同名标签文件并导入数据集);默认方式在 设置 → 界面 选择_r1/_r2… 并自动导入数据集_crop 副本(标签文件一并复制)
入口:数据集右键、文件夹组头右键,或 工具 → 多重切割…。不必先点一张图:来源可选 选中的图片 / 当前文件夹 / 全部图片。窗口左侧预览第一张来源图的切割框(YOLO 模式不在此跑检测)。把大图按训练档位压缩或切到指定比例,尽量留住高频细节;原图始终保留,每个勾选档位各出一份新文件并复制标签后导入数据集。
入口:数据集右键、文件夹组头右键,或 工具 → 预分桶…。来源为当前文件夹或全部图片。按分辨率 / 最小·最大边 / 划分单位算出桶,把每张图等比例放入、四周加白边扩到该桶的精确宽高,写出到当前数据集下的 {宽}x{高} 文件夹。标签文件一并复制;写完后删除已分出的原图和已空的原文件夹。
工具 → 视频格式转换… / 视频抽帧…。mp4 / mkv / avi / webm / mov / flv 互转(可替换原文件);全部帧 / 按 FPS / 原生 FPS / 指定帧号 / 随机百分比抽帧(分布抽帧或区域抽帧,滑条默认 10%),带预览与锁定帧流程;结果自动导入数据集。Release 包内置 FFmpeg。

多选图片后按 Shift+T 打开可视化编辑器:左侧标签列表(含出现次数、按频次排序)点击切换校对目标;绿框 = 已有该标签,红框 = 没有,点击图片上的 是/否 即可增删;跨标签修改一次「保存」统一生效。

入口:工具 → 按标签分类到文件夹…。勾选若干标签,确认后把同时带齐这些标签的图片移动到数据集根下的一个新文件夹,.txt / .caption 一起走。
Mix。已有同名文件夹时自动变成 Mix_2、Mix_310_miku入口:工具 → 查找相似图片…。参考 czkawka 的感知哈希方案(dHash + 汉明距离),直接用内存中的缩略图计算,数千张图秒级完成;选中某个文件夹时只扫描该范围,视频自动跳过。
入口:工具 → 扫描坏图…。在当前数据集(含文件夹范围)内逐张尝试解码,找出损坏、空文件或已缺失的图片;视频自动跳过。
入口:工具 → 替换透明背景(选中图片);数据集浏览器文件夹组头右键 → 替换透明背景(当前文件夹) / 替换透明背景(全部图片)。把透明底填成指定纯色、随机色,或从自建颜色列表里随机取色。
ImageLoader),编码按目标扩展名走 ImageEditorSaveService,WebP / TIFF / GIF 都能正常读写(旧版对 WebP 会报「Out of Memory」)入口:测试功能 菜单窗口的「错误标签修复」分组。扫描当前数据集(或选中的文件夹范围),把矛盾标签整理成「图片 / 移除 / 保留 / 原因」预览表,确认后一键应用——应用为普通编辑,可逐图撤销,不会自动写盘。
1boy 与 2boys 并存删低留高(同性别保留最大人数);多人图中的 solo 一并清除,含义不同的 solo focus 永不误伤racing miku ↔ hatsune miku 这类改名变体也能配对,同名不同人不会误合并)。不需要改角色名时取消勾选,人数冲突与 solo 仍会处理BooruDatasetTagManagerPlus.exe 本身就是命令行工具:第一个参数是已知命令时无窗口运行(输出可重定向,退出码 0/1/2 = 成功/运行错误/用法错误),否则照常打开界面。help 查看全部用法:
stats 统计;list-images / list-tags / classify-tags 查询(按标签、一二级类别、次数过滤;--category 可写「头发」或 Hair,头发/发色 筛二级);add-tags / remove-tags / replace-tag 批量改标(条件筛选、--dry-run 预演);export 导出 JSONfix-tags:错误标签修复的命令行版,--no-character-variants 跳过角色类替换,--child-threshold 调信任阈值(默认 0 关闭;与 --no-character-variants 同时使用无效)、--catalog 指定自定义关系表onnx-models / onnx-tag:Tag 推标 的命令行版(本地 ONNX)——列出 / 自动下载模型(受限模型支持 --hf-token),阈值与写入模式与界面同语义,「跳过已有」在推理前过滤。OppaiOracle 示例:onnx-tag --model oo:Grio43/OppaiOracle:v1.1。动词名未改,与旧脚本兼容audit:LLM 角色标签审查——沿用界面保存的 API 配置与审查提示词,两阶段审查后事务化写回,--report 输出 JSON 报告,--dry-run 只看决策settings.json(界面偏好 + LLM/API,密钥 DPAPI 加密)写在「文档\BooruDatasetTagManagerPlus」;设置 → 常规 显示实际路径。换 Debug / Release / dist 会读同一份;文档里还没有时整份复制程序目录旧文件(含 .bak);文档里已有空配置、但程序目录仍能识别到旧 API 时,只把端点 / 密钥 / 站点配置迁过去,不覆盖界面偏好,也不删旧文件。换电脑仍需重填密钥debug.log(菜单内可一键打开),便于反馈问题时附上日志Windows tag editor for LoRA / character image datasets: booru tag editing with Chinese UI & translation, WD14/PixAI/CL ONNX auto-tagging, LLM captioning, AI character-tag audit (dual-character support), RMBG background removal, image editor, video frame extraction. Fork of starik222/BooruDatasetTagManager.
C#
18
29 commits
updated Oct 2, 2026
面向 LoRA / 角色数据集的 Windows 打标工具,fork 自 starik222/BooruDatasetTagManager。
每张图配一个同名 .txt 存放标签,加载文件夹就能改。也能用 LLM 或本地 Tag 推标(原名 ONNX 推标;引擎是 WD14 / PixAI / CL / OppaiOracle)自动打标,并做角色审查、用中文搜标签。界面默认简体中文。MIT License。

从 Releases 下载 BooruDatasetTagManagerPlus-*-win-x64.zip,解压后运行 BooruDatasetTagManagerPlus.exe(自包含,无需安装 .NET)。
.txt 的数据集);「重新导入当前数据集」(F5)随时从磁盘刷新当前目录BooruDatasetTagManagerPlus.exe help 列出全部命令(统计 / 批量改标 / 导出 / fix-tags 修复 / onnx-tag 推标 / audit 审查)dotnet build BooruDatasetTagManager.sln -c Debug -f net8.0-windows
dotnet test BooruDatasetTagManager.Tests\BooruDatasetTagManager.Tests.csproj
dotnet publish BooruDatasetTagManager\BooruDatasetTagManager.csproj -c Release -f net8.0-windows -r win-x64 --self-contained true -o dist
test_start.bat — 启动 Release(或 Debug)quick_build.bat — 本地快速打包至 dist/(首次构建自动下载 FFmpeg)运行后程序目录会生成 Models/(下载的 ONNX 模型)、Cache/(缓存)。settings.json(API 与偏好设置)保存在「文档\BooruDatasetTagManagerPlus」,换安装目录也能读到同一份;文档里还没有文件时会从程序目录整份复制,若文档里已是空配置而程序目录仍能识别到旧的 API(端点 / 密钥 / 站点配置),则只把这些 API 字段迁过去。均为本地自动生成数据,可随时删除——设置恢复默认,模型可在应用内重新下载。
| 类别 | 包含 |
|---|---|
| 打标 | LLM(标签 / 自然语言)· Tag 推标(本地 ONNX:WD14 / PixAI / CL / OppaiOracle)· 角色审查(最多 4 人) |
| 标签 | 中文搜索、类别着色与一二级筛选、错误标签修复、按标签筛图 |
| 图片 | 编辑器、批量裁剪、多重切割(含 YOLO)、预分桶、抠图 / 换透明底 |
| 整理 | 文件夹浏览与预览、按标签分文件夹、按分辨率分桶、相似图、坏图扫描、视频转换 / 抽帧 |
| 命令行 | 同一 exe:统计、批量改标、导出、Tag 推标(onnx-tag)、审查 |
数据集面板是一个统一浏览器:顶部搜索框同时过滤文件夹与文件名;kohya 重复文件夹显示为可折叠分组(多文件夹默认全部折叠,搜索框右侧有全部展开 / 全部折叠、平铺视图与排序按钮;平铺开启时忽略文件夹分组、把当前范围与筛选结果摊平为一列),点击文件夹名即可把数据集范围限定到该文件夹(全部标签计数、批量操作与审查向导同步跟随);图片行显示缩略图、文件名与「格式 · 像素 · 大小」,选择操作与文件管理器一致(Ctrl / Shift / Ctrl+A / 方向键 / 右键菜单 / Delete)。
.txt 同步改名);Tag 推标此文件夹 / LLM 打标此文件夹Data/danbooru_dataset_general.csv)带一二级分类,启动时加载;long_hair 与 long hair 都能对上。查不到的标签进「一般」Data/danbooru_character_tags.csv,含约 2.6 万条真实父子关系),角色标签精确识别着色,翻译显示为「译名 (作品)」;可在 设置 → 翻译 关闭。CSV 不含角色名,角色类仍靠这份表 / Danbooru 类型列
工具 是一段平铺下拉,用淡色底栏分成三类(标题不可点,混色方式与标签类别着色相同,浅色 / 深色主题都能看清):
错误标签修复仍在顶栏 测试功能 窗口;角色标签审查在标注工具和该窗口都能打开。
入口:工具 → LLM 打标…、数据集右键,或标签工具栏「自动生成标签」。使用前先在 LLM 设置 配置 OpenAI 兼容端点、文本 / 视觉模型与全局 LLM 并发(默认 5,范围 1–100)。


数据集目录_captioned/(源 .txt 只读、可跳过已有),也可就地写回原图 .txt入口:工具 → 角色标签审查…(测试功能 窗口里也有同一入口)。设定锁定触发词(强制保留)、标签方法(少标法只留核心特征 / 全标法保留全部正确细节)、最小出现次数与标准图后,AI 按角色最多发起 3 次请求:文本初筛、视觉复核,再对仍无颜色的穿戴标签与同槽位簇(如 bow / hair ribbon / hairband)做一次定向解析(流程不可回退,改参数请取消后重开)。最后逐条复核(保留 / 删除 / 替换 / 不确定):同簇标签加同色底纹,悬停列出簇成员;替换目标优先用词表内已有标签。预览最终角色提示词后,应用并保存为事务写盘、失败自动回滚。
支持多角色数据集(最多 4 人):主体模式选择 双人 或 多角色 后,为每个角色设定触发词、标准图与性别(留空的角色行自动跳过,因此三人数据集也适用);图片按触发词、再按文件夹自动归属,多人同图自动补齐 2girls、multiple girls 等主体数标签,AI 审查、逐条复核与应用均逐角色进行,某个角色失败时可只重试该角色(已完成角色的结果保留)。

原名 ONNX 推标。1.2.6 起界面统一为 Tag 推标(英文 Tag tagger):工具 → 标注工具 菜单、推标窗口标题、数据集右键 Tag 重新推标、文件夹右键 Tag 推标此文件夹…。引擎是本机 ONNX(WD14 / PixAI / CL / OppaiOracle),权重仍下到 Models/,命令行动词仍是 onnx-tag / onnx-models。
入口:工具 → Tag 推标…,或数据集右键 Tag 重新推标(自动开始);文件夹右键 Tag 推标此文件夹… 会预选「当前文件夹」来源,确认设置后再开始。

Models 目录入口:工具 → 快速替换…。左侧选规范词、设阈值,右侧预览将并入的同类低频标签,底栏左侧显示当前状态,确认后整库替换。同类按最后一个词判断(black shoes → shoes);出现次数低于阈值才会被换。
入口:工具 → 背景移除,或数据集右键 移除背景。内置 RMBG-1.4 ONNX 本地抠图,无需外部服务;首次使用一键下载模型(约 176 MB,或量化版约 44 MB,官方 / 镜像源)。

_nobg.png 副本(选项记忆);完成后自动刷新缩略图或导入副本入口:数据集右键 编辑图片。仿 Photoshop 布局:左侧紧凑工具箱、顶部选项栏、底部状态栏。

[/] 笔刷大小、Alt+点击 临时取色、滚轮以光标为中心缩放、Ctrl+0 适应窗口、Ctrl+1 100%、Ctrl+Z / Ctrl+Shift+Z / Ctrl+Y 撤销重做(整笔一步,最多 15 步)、Enter 应用裁切、Ctrl+S 保存_edit 副本(自动克隆同名标签文件并导入数据集);默认方式在 设置 → 界面 选择_r1/_r2… 并自动导入数据集_crop 副本(标签文件一并复制)
入口:数据集右键、文件夹组头右键,或 工具 → 多重切割…。不必先点一张图:来源可选 选中的图片 / 当前文件夹 / 全部图片。窗口左侧预览第一张来源图的切割框(YOLO 模式不在此跑检测)。把大图按训练档位压缩或切到指定比例,尽量留住高频细节;原图始终保留,每个勾选档位各出一份新文件并复制标签后导入数据集。
入口:数据集右键、文件夹组头右键,或 工具 → 预分桶…。来源为当前文件夹或全部图片。按分辨率 / 最小·最大边 / 划分单位算出桶,把每张图等比例放入、四周加白边扩到该桶的精确宽高,写出到当前数据集下的 {宽}x{高} 文件夹。标签文件一并复制;写完后删除已分出的原图和已空的原文件夹。
工具 → 视频格式转换… / 视频抽帧…。mp4 / mkv / avi / webm / mov / flv 互转(可替换原文件);全部帧 / 按 FPS / 原生 FPS / 指定帧号 / 随机百分比抽帧(分布抽帧或区域抽帧,滑条默认 10%),带预览与锁定帧流程;结果自动导入数据集。Release 包内置 FFmpeg。

多选图片后按 Shift+T 打开可视化编辑器:左侧标签列表(含出现次数、按频次排序)点击切换校对目标;绿框 = 已有该标签,红框 = 没有,点击图片上的 是/否 即可增删;跨标签修改一次「保存」统一生效。

入口:工具 → 按标签分类到文件夹…。勾选若干标签,确认后把同时带齐这些标签的图片移动到数据集根下的一个新文件夹,.txt / .caption 一起走。
Mix。已有同名文件夹时自动变成 Mix_2、Mix_310_miku入口:工具 → 查找相似图片…。参考 czkawka 的感知哈希方案(dHash + 汉明距离),直接用内存中的缩略图计算,数千张图秒级完成;选中某个文件夹时只扫描该范围,视频自动跳过。
入口:工具 → 扫描坏图…。在当前数据集(含文件夹范围)内逐张尝试解码,找出损坏、空文件或已缺失的图片;视频自动跳过。
入口:工具 → 替换透明背景(选中图片);数据集浏览器文件夹组头右键 → 替换透明背景(当前文件夹) / 替换透明背景(全部图片)。把透明底填成指定纯色、随机色,或从自建颜色列表里随机取色。
ImageLoader),编码按目标扩展名走 ImageEditorSaveService,WebP / TIFF / GIF 都能正常读写(旧版对 WebP 会报「Out of Memory」)入口:测试功能 菜单窗口的「错误标签修复」分组。扫描当前数据集(或选中的文件夹范围),把矛盾标签整理成「图片 / 移除 / 保留 / 原因」预览表,确认后一键应用——应用为普通编辑,可逐图撤销,不会自动写盘。
1boy 与 2boys 并存删低留高(同性别保留最大人数);多人图中的 solo 一并清除,含义不同的 solo focus 永不误伤racing miku ↔ hatsune miku 这类改名变体也能配对,同名不同人不会误合并)。不需要改角色名时取消勾选,人数冲突与 solo 仍会处理BooruDatasetTagManagerPlus.exe 本身就是命令行工具:第一个参数是已知命令时无窗口运行(输出可重定向,退出码 0/1/2 = 成功/运行错误/用法错误),否则照常打开界面。help 查看全部用法:
stats 统计;list-images / list-tags / classify-tags 查询(按标签、一二级类别、次数过滤;--category 可写「头发」或 Hair,头发/发色 筛二级);add-tags / remove-tags / replace-tag 批量改标(条件筛选、--dry-run 预演);export 导出 JSONfix-tags:错误标签修复的命令行版,--no-character-variants 跳过角色类替换,--child-threshold 调信任阈值(默认 0 关闭;与 --no-character-variants 同时使用无效)、--catalog 指定自定义关系表onnx-models / onnx-tag:Tag 推标 的命令行版(本地 ONNX)——列出 / 自动下载模型(受限模型支持 --hf-token),阈值与写入模式与界面同语义,「跳过已有」在推理前过滤。OppaiOracle 示例:onnx-tag --model oo:Grio43/OppaiOracle:v1.1。动词名未改,与旧脚本兼容audit:LLM 角色标签审查——沿用界面保存的 API 配置与审查提示词,两阶段审查后事务化写回,--report 输出 JSON 报告,--dry-run 只看决策settings.json(界面偏好 + LLM/API,密钥 DPAPI 加密)写在「文档\BooruDatasetTagManagerPlus」;设置 → 常规 显示实际路径。换 Debug / Release / dist 会读同一份;文档里还没有时整份复制程序目录旧文件(含 .bak);文档里已有空配置、但程序目录仍能识别到旧 API 时,只把端点 / 密钥 / 站点配置迁过去,不覆盖界面偏好,也不删旧文件。换电脑仍需重填密钥debug.log(菜单内可一键打开),便于反馈问题时附上日志