免费开源的 AI 剪辑 / 直播切片工具:长视频、直播回放、播客一键切成爆款竖屏短视频,直发抖音/快手/B站/小红书/视频号——AI 找高光金句、弹幕热度进爆点判断、自动加字幕、横屏转竖屏,本地运行无水印不上传 | Free open-source Opus Clip alternative, 100% local: AI clips long videos & livestream VODs into viral 9:16 shorts for TikTok & YouTube Shorts. No credits, no watermark, no uploads. Win/macOS/Linux.
166
stars
177
commits
TypeScript
primary language
Sep 5, 2026
updated
长视频、直播回放一键切成爆款竖屏短视频
简体中文 | English | 官网 | 下载 | FAQ | 反馈
AI 自动找爆点(附理由) · 横屏转竖屏 9:16 · 自动加动态字幕 · 去气口剪口头禅
无水印 · 无积分制 · 不限时长 · 素材不上传 · 连注册都不用
本地转写现支持分段保存、停止与续跑;逐句稿提供跨句全文搜索、长稿虚拟列表,以及可试听、确认和撤销的局部时间校准。导出自动改善不同语言的字幕阅读节奏。可选 Qwen3-ASR 本地服务与模型评估命令见 语音与长稿使用指南。
导出页会显示素材检查、字幕翻译、文案生成、多版准备、编码和文件整理阶段。准备阶段即可取消,停止清理结束后可以直接重试;重复启动不会覆盖正在运行的任务。进度在文件整理完成前最高显示 99%。关闭烧录字幕、只打开 SRT 导出时,也会保留逐字稿供字幕文件使用。
常规剪切、跳剪、音频成片、合集与动态字幕编码先写目标目录内的独立临时文件,成功关闭编码器后才替换目标。失败或取消的这次编码不会把已有目标文件截断;同一批此前完成的切片保留。普通取消会清理临时目录;系统强制结束进程时可能留下隐藏的 .hotclip-write-* 目录,需在确认没有导出运行后再处理。这是逐次编码的文件保护,不是整批回滚。
专业工作台 —— 预览、时间轴、候选表、详情栏一屏工作:弹幕/响度热度曲线直接画在时间轴上,候选段就落在峰上,「为什么选这段」一眼可见;每条候选附爆款分、四维分项与逐字精确切点,弱片自动标「不建议发布」,勾选取舍全在你手。
![]() ① 导入 播客 / 直播回放 / 课程 —— 全程本地处理,素材不上传 | ![]() ② 选转写引擎 —— 素材常驻工作台,三档本地(SenseVoice / Paraformer / FireRedASR2)+ 可选云端,隐私分级明标 |
![]() ③ 逐句稿页签 —— 带时间戳、即点即改,点时间码画面直接跳过去;是找爆点和字幕的地基 | ![]() ④ 一键出片 —— 出片方案一键复用,竖屏成片直接发,附封面图与 clips.json 元数据 |
截图为真实界面(演示素材:一段带货直播回放)。觉得切得准,就点个 ⭐——每颗星都是让更多人不用再给积分制付费的一票,Star + Watch 还能第一时间收到新版本通知。
| 平台 | 文件 | 说明 |
|---|---|---|
| Windows 安装版 | HotClip-x.y.z-win-x64.exe | 双击安装即用 |
| Windows 绿色版 | HotClip-x.y.z-win-x64.zip | 免安装,解压即用 |
| macOS(Apple 芯片) | HotClip-x.y.z-mac-arm64.dmg | 拖进「应用程序」 |
| Linux(实验性) | HotClip-x.y.z-linux-x64.AppImage | chmod +x 后运行;启动报 sandbox 错误加 --no-sandbox |
⚠️ 当前版本未做代码签名:Windows SmartScreen 提示时点「更多信息 → 仍要运行」;macOS 首次打开用右键 → 打开(或到「系统设置 → 隐私与安全性」允许)。代码签名已在规划中。
不用 Python、不用 Docker、不用命令行——下载安装包双击即开。
市面上的 AI 切片工具,要么按分钟扣积分(一期 2 小时播客烧光整月额度,积分月底还清零),要么必须上传云端(未发布素材/客户内容不敢传),要么切点稀烂、中文支持名不副实;开源侧则几乎全是命令行,小白装不起来。HotClip 把两边的坑同时填上:
| HotClip | OpusClip / Klap / Vizard 等 SaaS | 剪映/CapCut 智能切片 | FunClip / autoclip 等开源 | |
|---|---|---|---|---|
| 价格 | 免费开源 | $15-29+/月,按源视频分钟扣积分,积分月底清零 | 核心功能进会员/Pro | 免费 |
| 素材去向 | 全程本地,不上传 | 必须上传云端 | 云端处理为主 | 本地 |
| 水印/时长限制 | 无 | 免费档有水印、限时长、项目 3 天过期 | 部分模板有限制 | 无 |
| 账号 | 无需注册 | 需注册,退订删项目 | 需登录 | 无 |
| 小白可用 | 双击安装即用 | 网页版,易用 | 易用 | 命令行/Docker/自部署 |
| 切点质量 | 逐字对齐精确到词,附理由可否决 | 黑盒打分,常被抱怨断章取义 | 黑盒 | 按句切,无爆点排序 |
| 竖屏字幕 | 9:16 重构 + 逐字点亮字幕内置 | 有(付费档) | 自动字幕已进付费 | 多数无竖屏重构 |
竞品信息核对于 2026-07,具体以各家官网为准。详细英文对比:HotClip vs OpusClip
「导入 → AI 找爆点 → 竖屏+逐字字幕成片」三步全流程可下载可用。每组点开看细节——细节里全是真功能,不是形容词。
已有原文字幕时,在转写页点击 导入字幕,选择与当前素材对齐的 UTF-8 SRT / WebVTT,即可进入逐句稿、纠错和文字选段;需要 AI 分析时再点击检测。导入本身不运行 ASR,也不覆盖已有转写缓存。保留字幕原句时间,句内字词时间明确标记为估算,可通过「需复核」筛选检查;手动拼接严格遵守选段边界。
CLI 的 transcribe、highlights、clip 均支持 --subtitles "/path/original.srt",三个 MCP 工具均支持 subtitlePath。例如 pnpm cli transcribe "/path/video.mp4" --subtitles "/path/original.vtt" --json 可输出带时间来源的结构化逐句稿。支持单轨原文字幕,最大 5 MB、20,000 段、100,000 字词;重叠、乱序、超出素材时长或带流媒体时间映射的字幕会提示修正后再导入,不会静默丢句。
快速 SenseVoice(五语种,170MB)/ 均衡 Paraformer(中文更准)/ 最准 FireRedASR2(普通话/方言/中英混说)——全部本地运行、普通 CPU 就能跑,首次自动下载(国内镜像优先、断点续传);另有云端档 ElevenLabs(自带 Key,只上传音轨)。
LLM 只负责«挑哪段»并引用原文,时间戳由逐字转写反向对齐——不让 AI 猜时间。每条候选附爆款分、开场钩子、推荐理由与四维分项,弱片自动标「不建议发布」。
qwen3.5:4b,一个多模态模型同时处理文字与九宫格接触表,研判画面高能时刻,专治逐字稿里看不见的画面梗;端点不可用自动跳过,不会挡住纯文字找爆点--reference)pnpm cli feedback,HotClip 在本机归纳高/低表现内容的题材、钩子与时长共性;桌面端/CLI/MCP/录播监听下一轮找爆点都会参考真实观众结果,不照抄旧标题、不上传账号数据动态字幕多款样式一档切换——关键词高亮、大字弹出、气泡特效、动态极简——词级时间戳驱动、语义断行不拦腰截断,SRT 可导出、双语可选;AI 起的爆款标题自动烧进顶部贴片,发布文案带标签生成。
[br],但零额外调用.post.txt 与 clips.json;8 种钩子角度 × 5 类 CTA 可选舒适优先智能取景、气口跳剪、剪口头禅、响度归一 -14 LUFS、帧精确切割——制作链一步到位,每条切片出片后还有自我质检。
clips.json 记录每条成片锁定/多人锁定/跟随/丢失回正/居中兜底的镜头数;镜头锁定会保持到下一次切镜,跳剪也不会让裁窗穿过被删区间clips.jsonclips.jsonclips.json 区分“智能生效 / 已回退 / 未应用”,字幕和逐字稿不改clips.json,问题可定位而不是只报一个“失败”导出前应用内看片微调:切片审阅台(波形时间轴拖手柄逐词调切点)、字幕安全区预览(九平台真实遮挡遮罩)、出片偏好记忆、品牌样式模板。
空格/K 播放、J/L 前后 5 秒、I/O 设入出点、[/] 切换候选,输入框和弹窗中自动让出timeline.edl(CMX3600)含跳剪的每一刀,导入 DaVinci / Premiere 重链源片继续精修2026 年的分发环境:像素级搬运判定、AIGC 强制标识、收藏率权重——切得好只是一半,这组功能管另一半:发出去不被判搬运、被质疑时拿得出证据。
一键全托管(导入后点一个按钮全自动出片)+ 录播监听 7×24 无人值守 + Headless CLI + 本地 MCP Server——唯一本地不上传的切片 Agent 工具链。
持久任务中心:录播监听与 webhook 共用单并发队列,任务阶段、历史与重试次数落盘;可取消、可手动重试,应用重启后运行中任务标记为「已中断」而不是偷偷续跑,凭据从不写进历史
长视频性能层:相同源文件、切点与基础效果重复导出时直接复用本地基础成片;H.264 连续片段仅在起点确认对齐关键帧且没有画面滤镜时直拷视频,音频仍执行淡化、降噪、响度和敏感词静音,失败透明回退精确编码。缓存按最近使用自动限制在 1GB,设置页可查看并单独清理
录播监听(7×24 无人值守):盯住录播姬/OBS 输出目录,新录播落稳自动转写→找爆点→出片;「连续两轮大小不变」才算录完绝不切半截
桌面健康检查:设置页一键检查 FFmpeg/FFprobe、解析工具、11 类模型、LLM 连通/鉴权/路由、磁盘、转写缓存、渲染缓存与多模态证据索引;缺少核心模型时显式准备,支持取消与断点续传;1GB 渲染缓存与 64MB 证据索引可分别安全清理
Headless CLI(与桌面端产物完全一致):
pnpm cli transcribe 直播回放.mp4 # 端侧逐字转写(带缓存)
pnpm cli highlights 直播回放.mp4 --json # AI 爆点候选,先审后剪
pnpm cli clip 直播回放.mp4 --max-clips 10 --smart-denoise # 全托管 + 48k 智能人声增强
pnpm cli feedback bilibili.csv # 导入真实播放/互动表现
pnpm cli feedback-report # 查看已学到的高/低表现模式
pnpm cli doctor --download # 环境自检 + 预下载模型
本地 MCP Server:Claude Code / Claude Desktop 注册后,一句「把这个 4 小时录播切 10 条爆点」就是完整交付;三个工具 clip_video / detect_highlights / transcribe_video
{
"mcpServers": {
"hotclip": {
"command": "npx",
"args": ["-y", "tsx", "src/mcp/server.ts"],
"cwd": "/path/to/hotclip",
"env": {
"HOTCLIP_LLM_BASE_URL": "http://localhost:11434/v1",
"HOTCLIP_LLM_MODEL": "qwen3:8b"
}
}
}
}
官方 Agent Skill:把这段话直接粘给 Claude Code / Codex,Agent 会自己完成安装:
请安装 HotClip 作为我的本地切片技能:
git clone https://github.com/xixihhhh/hotclip.git && cd hotclip && pnpm install,然后把skills/hotclip/复制到我的 Agent skills 目录(Claude Code 为~/.claude/skills/hotclip/),并按skills/hotclip/SKILL.md里的说明配置 LLM 环境变量。装好后用一段测试视频跑pnpm cli highlights验证。
clips.json 处理回执:每条片 AI 动了什么(字幕样式/取景模式/跳剪比例/语音证据覆盖与保护剪口/对齐覆盖/字幕质检/封面选择模式与得分/剪了几个口头禅)一目了然,可审计,矩阵管线直接取用
质量黄金集:pnpm quality:eval [fixture.json] 本地输出 CER/WER、词边界中位/P95 误差与爆点 recall@3/@5;以后换模型、调阈值先跑同一套样本,质量变化有数可查
本地视觉模型对比入口:HOTCLIP_VISION_MODELS=qwen3-vl:4b,qwen3.5:4b pnpm quality:eval:vision 用同一批演示片、同一套九宫格与结构化解析比较成功率、耗时和画面证据;模型由你的 Ollama 管理,HotClip 不捆绑数 GB 权重
模型自带干粮也行:默认本地免费模型;更强的爆点判断可一键接 Atlas Cloud、fal.ai 或任意 OpenAI 兼容接口,或本机 Ollama 完全离线
v0.28.0 (2026-09-05):字幕导入与长稿编辑(SRT / WebVTT、跨句搜索、局部校准预览与撤销);本地语音续跑(分段保存、停止恢复、可选 Qwen3-ASR);字幕阅读节奏优化与更可靠的导出(准备阶段取消、安全写入、直接重试、仅导出 SRT)。完整发布说明。
v0.27.0(2026-08-31)「先把人声听清,再谈包装」:48kHz 智能人声增强(显式智能档首次按需下载约 10MB、SHA-256 校验的 DPDFNet2,按声道分块处理完整剪辑,视频流直拷);发布链路顺序正确(在高潮前置/多片段组装之后、音效与 BGM 混入之前处理原声,响度在增强后统一,避免把包装层当噪声);可用性优先(模型、下载、解码或推理异常自动回退原有基础降噪,关闭/基础档行为不变,完成页与 clips.json 如实记录智能生效/回退/跳过);端侧多模态预设升级(新用户本地视觉端点默认 qwen3.5:4b,文字与接触表共用同一模型,并新增可复现的本地 VLM 对比命令);桌面、CLI 与 MCP 共用同一档位语义,真实官方模型 48k 冒烟与 FFmpeg 集成回归通过
v0.26.0(2026-08-31)「切得更紧,但一个尾音也不赌」:本地语音活动证据(复用现有 sherpa-onnx 原生运行时,新增经 SHA-256 校验的 629KB 模型,不装 Python、不上传音频);安全外边界(只在语音与逐字时间相互印证时,于 0.6 秒硬上限内保护开头/结尾尾音并约束后续镜头吸附,手调与拼接外边界不动);三重跳剪门(无词、低峰值且 VAD 无人声才删,ASR 漏掉的轻声/短词会保留);多音轨一致(语音与响度证据显式读取最终渲染选中的同一条音轨);可审计回退(clips.json 记录覆盖率、边界位移与保护剪口,长区间/低覆盖/模型或解码失败完全回退既有行为);真实带前后静音语音样片与多音轨 FFmpeg 回归通过
v0.25.0(2026-08-30)「分析看对画面,封面挑对一帧」:全分析链路同轨(运动/镜头/画面统计、TransNetV2、表情抽帧、VLM 接触表、候选复核、时间轴胶片带、去录屏 UI 与人脸取景全部绑定最终渲染选中的全局视频轨);HDR 分析预览(仅对元数据完整且可执行的 PQ/HLG 路径先做同款 SDR 预览再缩放/取样,普通 SDR 与不完整 HDR 保持既有 fail-open 行为);缓存不串画面(Tier-0、镜头与视觉证据按选中轨和色彩计划版本隔离);质量排序封面(响度峰与均匀时刻共同提名,在最终 QA 后成片上用捆绑 FFmpeg 淘汰黑白场、低信息/模糊与不稳定过渡帧,变体取下一名,失败精确回退旧时刻);无新增模型、依赖、下载、上传或云端费用,真实双视频轨 PQ 样片与四场景封面黄金集进入回归
v0.24.0(2026-08-30)「HDR 色彩不靠猜,能安全转才转」:严格元数据门(读取像素格式、位深、原色/传递/矩阵/范围与可用的 MaxCLL / mastering 峰值;PQ/HLG 还需完整且经捆绑运行时验证的 BT.2020 非恒定亮度色彩路径才转换,不凭 10-bit 或 BT.2020 单项猜测);受控转成 SDR BT.709(显式输入色彩→线性化→保色优先 Mobius tone map→10 到 8-bit 误差扩散抖动,最后写入 TV-range BT.709 标签);异常也不藏(HDR 路径不完整/不支持时提示未转换,色彩检查失败时单独提示检查失败,两者都禁用不适用的 SDR 域智能校正;桌面/CLI/MCP 与 clips.json 状态一致);全渲染路径一致(连续剪、跳剪、多片段、高潮前置、字幕叠加与质检修复共享决定);单视频轨 SDR 的像素处理与安全直拷判定不变,多轨则显式选中同一画面并按所选轨隔离缓存,全程本地且无新模型/下载
v0.23.0(2026-08-30)「画面里写着什么,也应该成为证据」:屏显文字证据(复用已经开启的全场视觉扫描与候选复核,不装新 OCR、不增加模型调用;只保留可逐字确认的产品名、价格、比分、标题与 PPT 要点,不确定就留空);静态内容不漏(为低画面能量但有清晰文字的价格牌/PPT 保留证据席位,让带货、课程、评测的关键事实进入选段提示);结构化候选复核(实拍场景、画面分、标题匹配与屏显文字进入候选数据、CLI/MCP 输出和 clips.json,审阅台中英双语直接可见);封面更对题(AI 封面优先使用视觉复核观察到的真实场景,不再只靠转写钩子猜画面);沿用原有可选视觉开关,未开启时零额外成本、失败自动回退
v0.22.0(2026-08-30)「画面该救才救,正常素材一帧不乱动」:智能画面校正(桌面出片方案、CLI --auto-enhance 与 MCP 统一显式开启,默认关闭);片段级实测(复用已有 4fps Tier-0 解码采集亮度低位/均值/高位与饱和度,按跳剪或多片段最终保留的源时间单独统计,不新增模型和完整解码);克制有上限(只在证据充分且明显偏暗、发灰、过曝或过饱和时轻调亮度/反差/饱和度/gamma,正常素材不加滤镜,黑白素材不强行增艳);全链路一致(连续剪、跳剪和高潮前置使用对应窗口的校正,滤镜置于裁切缩放之后、字幕水印之前);可审计可复用(clips.json 记录测量、原因与精确调整,渲染缓存按派生方案区分,超长录播证据均匀有界)
v0.21.0(2026-08-30)「成片不只导出来,还要证明画面没坏」:冻结帧质检(同一次 FFmpeg 扫描识别持续 3 秒以上的异常静止画面,片尾冻结也能闭合记录);主体覆盖率(复用已有 YuNet 人脸采样,按最终竖屏裁窗统计未完整保留与严重出框帧,不新增模型扫描);镜头锁定修正(锁定构图真正保持到下一镜,不再缓慢漂向后续镜头);跳剪轨迹对齐(裁窗在删掉的源片区间前后瞬时衔接,不会隔着被删内容错误插值);冻结与构图属于需人工回放的语义告警,不会冒险自动重剪
v0.20.0(2026-08-30)「主体留在画里,镜头别乱跑」:舒适优先竖屏构图(逐镜头汇总所有可见人脸的安全包络,单人移动/多人对谈能装下就锁住机位,只有确实需要时才平滑跟随);居中吸附(原片已接近中心时尊重摄影构图,不制造无意义偏移);丢失回正(短暂漏检保持当前主体,持续 1.25 秒后平滑回到中心,不再长期守着空画面;无可靠人脸的新镜头立即居中);全链路回执(clips.json 记录镜头总数、锁定、多人锁定、跟随、回正与居中兜底数量,拼接片逐段聚合);不新增模型、不增加安装包体积,检测不足仍安全回退居中裁剪
v0.19.0(2026-08-28)「证据只算一次,下一刀更快更准」:本地多模态证据索引(源文件指纹、能力版本与模型共同定址,原子写入、损坏失效、最近使用淘汰,默认最多 64MB);九路证据链(新增无需模型的轻量运动峰值,与文本/响度/镜头/表情/视觉/弹幕/语气/笑声掌声共振);看得见的运动依据(工作台时间轴新增运动曲线,代表帧同时保留全场均匀覆盖);昂贵分析跨入口复用(Tier-0 信号、TransNetV2 镜头边界与可选 VLM 扫描在桌面、CLI、MCP、录播监听/webhook 间共享,模型或算法变化自动重算,API Key 不落盘);独立诊断与清理(证据索引与渲染/转写缓存互不误删,清理后二次生成即可恢复)
v0.18.0(2026-08-28)「质量看得见,升级有尺子」:逐词时间来源(原生/二遍对齐/内插/手工改稿/缺失估时,旧工程兼容);聚焦复核(逐句稿估时徽标与一键筛选,候选详情显示字幕时间回执);局部对齐报告(匹配覆盖、对齐/内插词数与不确定区间进入 clips.json);字幕质量门(无效时间、重叠、阅读速度、闪现、超宽词与估时区间按最终成片时间轴检查);可重复质量评测(本地黄金集命令输出 CER/WER、词边界误差和爆点 recall@K,不下载新模型);新增独立 dev:web 浏览器预览,清掉 Electron 运行包也能做 UI 回归
v0.17.0(2026-08-25)「长视频越剪越快」:有界基础渲染缓存(同源文件、切点、字幕/裁切/音频处理与品牌参数命中时直接复用,原子写入、损坏失效、最近使用淘汰,默认最多 1GB);安全智能直拷(仅 H.264 单连续片段、起点关键帧对齐且无画面滤镜时复制视频流,音频仍完整执行 AAC、边缘淡化、降噪、响度与敏感词静音,任何异常透明回退精确编码);全入口共享(桌面手动、录播监听/webhook、CLI 与 MCP 共用缓存);缓存诊断与清理(设置页双语显示占用,二次确认后只清可重复生成的基础成片,不碰项目、素材、模型和转写缓存)
v0.16.0(2026-08-25)「工程留得住,每一步都能回头」:项目工作区(多工程列表、切换、重命名、关闭、删除与媒体重连,源素材离线/变化不丢工程,旧会话自动迁移);可逆编辑历史(选片、标题/切点、手动加片、逐句稿纠错统一 undo/redo,60 步/4MB 双上限,随项目恢复);专业快捷键(播放/跳播/入出点/候选切换,输入框与弹窗安全让出);本地 A/B 实验中心(一片多版自动按平台建组,稳定内容 ID 关联指标,同平台/72 小时/最低样本门槛,只给谨慎的方向性判断)
v0.15.1(2026-08-24)「任务接得住,发完学得会」:硬件加速出片(VideoToolbox / NVENC / QSV 自动探测,失败透明回退 x264);真实表现中心(导入平台指标,高低表现模式回流选段);公开视频 URL 导入(B站 / YouTube 等地址,官方解析工具自动校验、断点续传);重启接着剪(素材、逐字稿、候选、勾选与手调切点恢复);持久自动化任务中心(录播监听 / webhook 共用队列,历史、取消、重试与中断状态落盘,不存凭据);敏感词音频静音(按逐字时间映射跳剪与多片段,字幕保留原文);发布反馈台账(稳定内容 ID、预填指标 CSV、保守匹配与待回填状态);桌面健康检查(工具、9 类模型、LLM、磁盘/缓存,核心模型准备可取消续传);主题系列整理(重复有效关键词自动分集,变体排除,附 manifest)
v0.15.0(2026-08-20)「向导退役、工作台上岗」:三栏工作台(三步向导退役——左栏素材与录播监听常驻,中央「源画面+竖屏 9:16 实时裁切+时间轴+候选密排表」,右栏候选详情与检测参数,全程一屏不跳页);时间轴上桌(全场响度曲线+弹幕热度曲线+胶片带缩略图,候选段直接画在曲线上,爆点落在哪一眼扫到);候选不怕退(候选与审阅状态进会话仓,切页返回不丢);显式重新检测(改检测参数不再静默重跑整轮,改完自己点「重新检测」);出片方案预设(33 个出片开关收进六组,默认出片/带货全家桶/极简省时三套方案一键切换);设置中心(散落七处的配置——AI 模型/转写引擎/导出与存储/品牌样式/热词词表/录播监听/语言——合并一页);弹幕这票投得更准——抖音直播录制弹幕 .jsonl 兼容(与 B 站录播姬 .xml 双格式自动发现,抖音主播的录播从此也有弹幕证据)、互动事件计权(SC/舰长/礼物/关注/点赞按档加权——花钱和动手的票比弹幕硬)、反刷屏(同一人单窗贡献封顶)、突发加成(相对前一窗跳升计分——爆点是「突然炸」)、信号融合升级(多路共振加成+内容自适应窗口)、弹幕引导采样(表情/语气这类贵模型的算力优先花在观众炸锅处);修复真机预览黑屏(多个 video 同载同一本地流 URL 在 Chromium 撞车)与胶片带缩略图被 CSP 拦截
variantOf,合集与 EDL 只收原版);音效打点与 BGM(whoosh 卡切缝、「叮」卡情绪峰、钩子上屏轻响,每条最多 3 个;BGM 循环铺满+人声闪避+结尾淡出,独立后处理趟零画质损失);动态极简字幕样式doctor 环境自检 + 模型下载断点续传 + 发布文案角度模板(8 钩子角度×5 CTA)+ 参考爆款入口补全| 里程碑 | 状态 |
|---|---|
| 桌面客户端 · 本地转写三档 · AI 找爆点 · 竖屏+字幕成片 · 舒适智能构图 | ✅ 已完成 |
| 说话人分离 · 气泡字幕 · 气口跳剪 · 一键全托管 · 安装包发布 | ✅ 已完成 |
| v0.5 ~ v0.9(审阅台 · MCP · 录播监听 · 质检修复 · 反馈回流 · 设置页) | ✅ 已发布 |
| v0.10 ~ v0.14(多片段拼接 · 品类判据 · 质量门三档 · 平台发布包 · 一片多版 · 剪映草稿 · 变形度评分 · AI 封面/配乐) | ✅ 已发布 |
| v0.15(三栏工作台 · 时间轴曲线 · 弹幕互动计权) | ✅ 已发布 |
| v0.15.1(硬件加速 · URL 导入 · 断点恢复 · 持久队列 · 发布反馈 · 健康检查 · 主题系列) | ✅ 已发布 |
| v0.16(项目工作区 · 可逆编辑 · 专业快捷键 · 本地 A/B 实验) | ✅ 已发布 |
| v0.17(有界渲染缓存 · 关键帧安全直拷 · 全入口共享 · 缓存诊断清理) | ✅ 已发布 |
| v0.18 ~ v0.27(质量评测 · 字幕质量门 · 多模态/屏显文字证据 · 舒适竖屏构图 · 成片质检 · 智能画面校正 · HDR 安全转 SDR · 同轨分析 · 质量封面 · 语音安全切点 · 48k 智能人声增强) | ✅ 已发布 |
| 英文 ASR 升级(Parakeet)· 代码签名 · 无人值守增强 | 🗺️ 规划中 |
完整更新历史见 Releases · 想投票决定先做哪个?到 Discussions 留言。
有什么免费的 AI 切片 / AI 剪辑软件? HotClip 就是——免费开源(AGPL-3.0)、本地运行的 AI 剪辑 / 视频切片工具,把长视频、直播回放一键切成竖屏短视频,无水印、无积分制、不限时长,Windows / macOS / Linux(实验)都有安装包。
直播回放 / 播客怎么一键剪成抖音、B站短视频? 导入文件 → AI 转写并自动识别高光片段(可手动增删调边界)→ 一键导出竖屏 9:16 成片,自带字幕、标题贴片和封面图,直接上传抖音 / 快手 / B站 / 视频号 / 小红书。
AI 剪辑会上传我的视频吗?需要联网吗? 不上传。转写、字幕、切片、导出全程在你自己的电脑上离线完成。只有「AI 找爆点」这一步默认调用云端大模型(只发文字稿,用你自己的 Key),接本机 Ollama 后 100% 离线。
能自动加字幕吗? 能。逐词同步的动态字幕直接烧进画面,关键词高亮/大字弹出/气泡特效等多款样式一档切换,也可导出 SRT 给平台原生上传;开双语字幕还能整句翻译烧成第二行。
能自动剪掉口播里的停顿和口头禅吗?视频如何去气口? 能。「剪气口」自动删掉说话间的静音停顿,「剪口头禅」剪掉嗯/呃与结巴重复——剪了什么逐条写进 clips.json,你始终知道 AI 动了哪里。
弹幕能参与选爆点吗?直播高光怎么找? 能,而且是最硬的证据。HotClip 自动发现录播旁的弹幕文件——B 站录播姬的同名 .xml、抖音直播录制工具的弹幕 .jsonl 都认;弹幕密度、SC / 舰长 / 礼物 / 关注 / 点赞互动直接进爆点判断(单人刷屏有封顶,突然爆发有加成)。没有弹幕文件也不要紧,响度 / 镜头 / 运动 / 表情 / 语气 / 笑声等信号照样兜底。
剪映可以自动切割片段吗?和 HotClip 怎么配合? 剪映的智能切片在会员档,且只能切连续区间。HotClip 免费开源、支持把相隔十几分钟的片段拼成一条,还能把每条切片导出成剪映草稿——AI 粗剪交给 HotClip,打开剪映接着精修,不冲突,是接力。
HotClip 和剪映 / OpusClip / Klap 这类工具的区别? 最大区别是素材不出你的电脑:OpusClip 等 SaaS 必须上传云端、按源视频分钟扣积分(积分月底清零),免费档带水印;剪映的智能切片等核心能力在会员档。HotClip 开源免费、本地处理、无水印、不限时长,AI 切点附理由可审计。详见上方对比表。
支持中文视频吗?方言、粤语呢? 支持且是强项。中文识别走专用引擎(SenseVoice/Paraformer/FireRedASR2),准确率显著高于通用模型;方言、粤语、中英混说都覆盖,界面、字幕、prompt 都针对中文内容做了适配。
需要显卡吗?配置要求高吗? 不需要。本地转写用 int8 量化小模型,普通 CPU 就能跑;找爆点的大模型在云端(或你本机的 Ollama)。
可以切别人的直播吗?直播切片如何申请授权? HotClip 面向你自己的内容或已获授权的切片。切别人的直播请先拿到授权(如各平台/公会的主播切片授权计划);未经授权的影视/直播搬运不受支持,也不欢迎。
首次使用,语音模型下载到 100% 又从头开始怎么办? 升级到 v0.9.1 或更新版本即可,老版本的 Windows 解压 bug 已彻底修复;旧版已下载的字节还会自动续传。
git clone https://github.com/xixihhhh/hotclip.git
cd hotclip
pnpm install
pnpm dev # 启动桌面应用(开发模式)
pnpm test # 跑单元测试
技术栈:Electron + React 19 + TypeScript + Tailwind 4 · ffmpeg(打包内置)· sherpa-onnx 本地转写 + 说话人分离 · libass 动态字幕 + 离屏 Chromium 气泡字幕引擎 · LLM 爆点检测(Atlas Cloud / Ollama / 任意 OpenAI 兼容接口,BYO Key)
| 项目 | 在 HotClip 中的角色 |
|---|---|
| sherpa-onnx | 本地语音识别运行时(纯 CPU 可跑) |
| SenseVoice / FunASR | 五语种快速转写 / Paraformer 中文转写与标点 |
| FireRedASR | 最高精度档:普通话/方言/中英混说 |
| pyannote-audio + 3D-Speaker | 说话人分离(本地零上传) |
| FFmpeg + libass | 帧精确切割 / 字幕烧录 |
| onnxruntime | 端侧模型推理 |
⭐ 觉得有用就点个 Star——Star + Watch 第一时间收到新版本通知,每颗星都是让更多人不用再给积分制付费的一票。
177 commits
TypeScript
99.3%
免费开源的 AI 剪辑 / 直播切片工具:长视频、直播回放、播客一键切成爆款竖屏短视频,直发抖音/快手/B站/小红书/视频号——AI 找高光金句、弹幕热度进爆点判断、自动加字幕、横屏转竖屏,本地运行无水印不上传 | Free open-source Opus Clip alternative, 100% local: AI clips long videos & livestream VODs into viral 9:16 shorts for TikTok & YouTube Shorts. No credits, no watermark, no uploads. Win/macOS/Linux.
166
stars
177
commits
TypeScript
primary language
Sep 5, 2026
updated
长视频、直播回放一键切成爆款竖屏短视频
简体中文 | English | 官网 | 下载 | FAQ | 反馈
AI 自动找爆点(附理由) · 横屏转竖屏 9:16 · 自动加动态字幕 · 去气口剪口头禅
无水印 · 无积分制 · 不限时长 · 素材不上传 · 连注册都不用
本地转写现支持分段保存、停止与续跑;逐句稿提供跨句全文搜索、长稿虚拟列表,以及可试听、确认和撤销的局部时间校准。导出自动改善不同语言的字幕阅读节奏。可选 Qwen3-ASR 本地服务与模型评估命令见 语音与长稿使用指南。
导出页会显示素材检查、字幕翻译、文案生成、多版准备、编码和文件整理阶段。准备阶段即可取消,停止清理结束后可以直接重试;重复启动不会覆盖正在运行的任务。进度在文件整理完成前最高显示 99%。关闭烧录字幕、只打开 SRT 导出时,也会保留逐字稿供字幕文件使用。
常规剪切、跳剪、音频成片、合集与动态字幕编码先写目标目录内的独立临时文件,成功关闭编码器后才替换目标。失败或取消的这次编码不会把已有目标文件截断;同一批此前完成的切片保留。普通取消会清理临时目录;系统强制结束进程时可能留下隐藏的 .hotclip-write-* 目录,需在确认没有导出运行后再处理。这是逐次编码的文件保护,不是整批回滚。
专业工作台 —— 预览、时间轴、候选表、详情栏一屏工作:弹幕/响度热度曲线直接画在时间轴上,候选段就落在峰上,「为什么选这段」一眼可见;每条候选附爆款分、四维分项与逐字精确切点,弱片自动标「不建议发布」,勾选取舍全在你手。
![]() ① 导入 播客 / 直播回放 / 课程 —— 全程本地处理,素材不上传 | ![]() ② 选转写引擎 —— 素材常驻工作台,三档本地(SenseVoice / Paraformer / FireRedASR2)+ 可选云端,隐私分级明标 |
![]() ③ 逐句稿页签 —— 带时间戳、即点即改,点时间码画面直接跳过去;是找爆点和字幕的地基 | ![]() ④ 一键出片 —— 出片方案一键复用,竖屏成片直接发,附封面图与 clips.json 元数据 |
截图为真实界面(演示素材:一段带货直播回放)。觉得切得准,就点个 ⭐——每颗星都是让更多人不用再给积分制付费的一票,Star + Watch 还能第一时间收到新版本通知。
| 平台 | 文件 | 说明 |
|---|---|---|
| Windows 安装版 | HotClip-x.y.z-win-x64.exe | 双击安装即用 |
| Windows 绿色版 | HotClip-x.y.z-win-x64.zip | 免安装,解压即用 |
| macOS(Apple 芯片) | HotClip-x.y.z-mac-arm64.dmg | 拖进「应用程序」 |
| Linux(实验性) | HotClip-x.y.z-linux-x64.AppImage | chmod +x 后运行;启动报 sandbox 错误加 --no-sandbox |
⚠️ 当前版本未做代码签名:Windows SmartScreen 提示时点「更多信息 → 仍要运行」;macOS 首次打开用右键 → 打开(或到「系统设置 → 隐私与安全性」允许)。代码签名已在规划中。
不用 Python、不用 Docker、不用命令行——下载安装包双击即开。
市面上的 AI 切片工具,要么按分钟扣积分(一期 2 小时播客烧光整月额度,积分月底还清零),要么必须上传云端(未发布素材/客户内容不敢传),要么切点稀烂、中文支持名不副实;开源侧则几乎全是命令行,小白装不起来。HotClip 把两边的坑同时填上:
| HotClip | OpusClip / Klap / Vizard 等 SaaS | 剪映/CapCut 智能切片 | FunClip / autoclip 等开源 | |
|---|---|---|---|---|
| 价格 | 免费开源 | $15-29+/月,按源视频分钟扣积分,积分月底清零 | 核心功能进会员/Pro | 免费 |
| 素材去向 | 全程本地,不上传 | 必须上传云端 | 云端处理为主 | 本地 |
| 水印/时长限制 | 无 | 免费档有水印、限时长、项目 3 天过期 | 部分模板有限制 | 无 |
| 账号 | 无需注册 | 需注册,退订删项目 | 需登录 | 无 |
| 小白可用 | 双击安装即用 | 网页版,易用 | 易用 | 命令行/Docker/自部署 |
| 切点质量 | 逐字对齐精确到词,附理由可否决 | 黑盒打分,常被抱怨断章取义 | 黑盒 | 按句切,无爆点排序 |
| 竖屏字幕 | 9:16 重构 + 逐字点亮字幕内置 | 有(付费档) | 自动字幕已进付费 | 多数无竖屏重构 |
竞品信息核对于 2026-07,具体以各家官网为准。详细英文对比:HotClip vs OpusClip
「导入 → AI 找爆点 → 竖屏+逐字字幕成片」三步全流程可下载可用。每组点开看细节——细节里全是真功能,不是形容词。
已有原文字幕时,在转写页点击 导入字幕,选择与当前素材对齐的 UTF-8 SRT / WebVTT,即可进入逐句稿、纠错和文字选段;需要 AI 分析时再点击检测。导入本身不运行 ASR,也不覆盖已有转写缓存。保留字幕原句时间,句内字词时间明确标记为估算,可通过「需复核」筛选检查;手动拼接严格遵守选段边界。
CLI 的 transcribe、highlights、clip 均支持 --subtitles "/path/original.srt",三个 MCP 工具均支持 subtitlePath。例如 pnpm cli transcribe "/path/video.mp4" --subtitles "/path/original.vtt" --json 可输出带时间来源的结构化逐句稿。支持单轨原文字幕,最大 5 MB、20,000 段、100,000 字词;重叠、乱序、超出素材时长或带流媒体时间映射的字幕会提示修正后再导入,不会静默丢句。
快速 SenseVoice(五语种,170MB)/ 均衡 Paraformer(中文更准)/ 最准 FireRedASR2(普通话/方言/中英混说)——全部本地运行、普通 CPU 就能跑,首次自动下载(国内镜像优先、断点续传);另有云端档 ElevenLabs(自带 Key,只上传音轨)。
LLM 只负责«挑哪段»并引用原文,时间戳由逐字转写反向对齐——不让 AI 猜时间。每条候选附爆款分、开场钩子、推荐理由与四维分项,弱片自动标「不建议发布」。
qwen3.5:4b,一个多模态模型同时处理文字与九宫格接触表,研判画面高能时刻,专治逐字稿里看不见的画面梗;端点不可用自动跳过,不会挡住纯文字找爆点--reference)pnpm cli feedback,HotClip 在本机归纳高/低表现内容的题材、钩子与时长共性;桌面端/CLI/MCP/录播监听下一轮找爆点都会参考真实观众结果,不照抄旧标题、不上传账号数据动态字幕多款样式一档切换——关键词高亮、大字弹出、气泡特效、动态极简——词级时间戳驱动、语义断行不拦腰截断,SRT 可导出、双语可选;AI 起的爆款标题自动烧进顶部贴片,发布文案带标签生成。
[br],但零额外调用.post.txt 与 clips.json;8 种钩子角度 × 5 类 CTA 可选舒适优先智能取景、气口跳剪、剪口头禅、响度归一 -14 LUFS、帧精确切割——制作链一步到位,每条切片出片后还有自我质检。
clips.json 记录每条成片锁定/多人锁定/跟随/丢失回正/居中兜底的镜头数;镜头锁定会保持到下一次切镜,跳剪也不会让裁窗穿过被删区间clips.jsonclips.jsonclips.json 区分“智能生效 / 已回退 / 未应用”,字幕和逐字稿不改clips.json,问题可定位而不是只报一个“失败”导出前应用内看片微调:切片审阅台(波形时间轴拖手柄逐词调切点)、字幕安全区预览(九平台真实遮挡遮罩)、出片偏好记忆、品牌样式模板。
空格/K 播放、J/L 前后 5 秒、I/O 设入出点、[/] 切换候选,输入框和弹窗中自动让出timeline.edl(CMX3600)含跳剪的每一刀,导入 DaVinci / Premiere 重链源片继续精修2026 年的分发环境:像素级搬运判定、AIGC 强制标识、收藏率权重——切得好只是一半,这组功能管另一半:发出去不被判搬运、被质疑时拿得出证据。
一键全托管(导入后点一个按钮全自动出片)+ 录播监听 7×24 无人值守 + Headless CLI + 本地 MCP Server——唯一本地不上传的切片 Agent 工具链。
持久任务中心:录播监听与 webhook 共用单并发队列,任务阶段、历史与重试次数落盘;可取消、可手动重试,应用重启后运行中任务标记为「已中断」而不是偷偷续跑,凭据从不写进历史
长视频性能层:相同源文件、切点与基础效果重复导出时直接复用本地基础成片;H.264 连续片段仅在起点确认对齐关键帧且没有画面滤镜时直拷视频,音频仍执行淡化、降噪、响度和敏感词静音,失败透明回退精确编码。缓存按最近使用自动限制在 1GB,设置页可查看并单独清理
录播监听(7×24 无人值守):盯住录播姬/OBS 输出目录,新录播落稳自动转写→找爆点→出片;「连续两轮大小不变」才算录完绝不切半截
桌面健康检查:设置页一键检查 FFmpeg/FFprobe、解析工具、11 类模型、LLM 连通/鉴权/路由、磁盘、转写缓存、渲染缓存与多模态证据索引;缺少核心模型时显式准备,支持取消与断点续传;1GB 渲染缓存与 64MB 证据索引可分别安全清理
Headless CLI(与桌面端产物完全一致):
pnpm cli transcribe 直播回放.mp4 # 端侧逐字转写(带缓存)
pnpm cli highlights 直播回放.mp4 --json # AI 爆点候选,先审后剪
pnpm cli clip 直播回放.mp4 --max-clips 10 --smart-denoise # 全托管 + 48k 智能人声增强
pnpm cli feedback bilibili.csv # 导入真实播放/互动表现
pnpm cli feedback-report # 查看已学到的高/低表现模式
pnpm cli doctor --download # 环境自检 + 预下载模型
本地 MCP Server:Claude Code / Claude Desktop 注册后,一句「把这个 4 小时录播切 10 条爆点」就是完整交付;三个工具 clip_video / detect_highlights / transcribe_video
{
"mcpServers": {
"hotclip": {
"command": "npx",
"args": ["-y", "tsx", "src/mcp/server.ts"],
"cwd": "/path/to/hotclip",
"env": {
"HOTCLIP_LLM_BASE_URL": "http://localhost:11434/v1",
"HOTCLIP_LLM_MODEL": "qwen3:8b"
}
}
}
}
官方 Agent Skill:把这段话直接粘给 Claude Code / Codex,Agent 会自己完成安装:
请安装 HotClip 作为我的本地切片技能:
git clone https://github.com/xixihhhh/hotclip.git && cd hotclip && pnpm install,然后把skills/hotclip/复制到我的 Agent skills 目录(Claude Code 为~/.claude/skills/hotclip/),并按skills/hotclip/SKILL.md里的说明配置 LLM 环境变量。装好后用一段测试视频跑pnpm cli highlights验证。
clips.json 处理回执:每条片 AI 动了什么(字幕样式/取景模式/跳剪比例/语音证据覆盖与保护剪口/对齐覆盖/字幕质检/封面选择模式与得分/剪了几个口头禅)一目了然,可审计,矩阵管线直接取用
质量黄金集:pnpm quality:eval [fixture.json] 本地输出 CER/WER、词边界中位/P95 误差与爆点 recall@3/@5;以后换模型、调阈值先跑同一套样本,质量变化有数可查
本地视觉模型对比入口:HOTCLIP_VISION_MODELS=qwen3-vl:4b,qwen3.5:4b pnpm quality:eval:vision 用同一批演示片、同一套九宫格与结构化解析比较成功率、耗时和画面证据;模型由你的 Ollama 管理,HotClip 不捆绑数 GB 权重
模型自带干粮也行:默认本地免费模型;更强的爆点判断可一键接 Atlas Cloud、fal.ai 或任意 OpenAI 兼容接口,或本机 Ollama 完全离线
v0.28.0 (2026-09-05):字幕导入与长稿编辑(SRT / WebVTT、跨句搜索、局部校准预览与撤销);本地语音续跑(分段保存、停止恢复、可选 Qwen3-ASR);字幕阅读节奏优化与更可靠的导出(准备阶段取消、安全写入、直接重试、仅导出 SRT)。完整发布说明。
v0.27.0(2026-08-31)「先把人声听清,再谈包装」:48kHz 智能人声增强(显式智能档首次按需下载约 10MB、SHA-256 校验的 DPDFNet2,按声道分块处理完整剪辑,视频流直拷);发布链路顺序正确(在高潮前置/多片段组装之后、音效与 BGM 混入之前处理原声,响度在增强后统一,避免把包装层当噪声);可用性优先(模型、下载、解码或推理异常自动回退原有基础降噪,关闭/基础档行为不变,完成页与 clips.json 如实记录智能生效/回退/跳过);端侧多模态预设升级(新用户本地视觉端点默认 qwen3.5:4b,文字与接触表共用同一模型,并新增可复现的本地 VLM 对比命令);桌面、CLI 与 MCP 共用同一档位语义,真实官方模型 48k 冒烟与 FFmpeg 集成回归通过
v0.26.0(2026-08-31)「切得更紧,但一个尾音也不赌」:本地语音活动证据(复用现有 sherpa-onnx 原生运行时,新增经 SHA-256 校验的 629KB 模型,不装 Python、不上传音频);安全外边界(只在语音与逐字时间相互印证时,于 0.6 秒硬上限内保护开头/结尾尾音并约束后续镜头吸附,手调与拼接外边界不动);三重跳剪门(无词、低峰值且 VAD 无人声才删,ASR 漏掉的轻声/短词会保留);多音轨一致(语音与响度证据显式读取最终渲染选中的同一条音轨);可审计回退(clips.json 记录覆盖率、边界位移与保护剪口,长区间/低覆盖/模型或解码失败完全回退既有行为);真实带前后静音语音样片与多音轨 FFmpeg 回归通过
v0.25.0(2026-08-30)「分析看对画面,封面挑对一帧」:全分析链路同轨(运动/镜头/画面统计、TransNetV2、表情抽帧、VLM 接触表、候选复核、时间轴胶片带、去录屏 UI 与人脸取景全部绑定最终渲染选中的全局视频轨);HDR 分析预览(仅对元数据完整且可执行的 PQ/HLG 路径先做同款 SDR 预览再缩放/取样,普通 SDR 与不完整 HDR 保持既有 fail-open 行为);缓存不串画面(Tier-0、镜头与视觉证据按选中轨和色彩计划版本隔离);质量排序封面(响度峰与均匀时刻共同提名,在最终 QA 后成片上用捆绑 FFmpeg 淘汰黑白场、低信息/模糊与不稳定过渡帧,变体取下一名,失败精确回退旧时刻);无新增模型、依赖、下载、上传或云端费用,真实双视频轨 PQ 样片与四场景封面黄金集进入回归
v0.24.0(2026-08-30)「HDR 色彩不靠猜,能安全转才转」:严格元数据门(读取像素格式、位深、原色/传递/矩阵/范围与可用的 MaxCLL / mastering 峰值;PQ/HLG 还需完整且经捆绑运行时验证的 BT.2020 非恒定亮度色彩路径才转换,不凭 10-bit 或 BT.2020 单项猜测);受控转成 SDR BT.709(显式输入色彩→线性化→保色优先 Mobius tone map→10 到 8-bit 误差扩散抖动,最后写入 TV-range BT.709 标签);异常也不藏(HDR 路径不完整/不支持时提示未转换,色彩检查失败时单独提示检查失败,两者都禁用不适用的 SDR 域智能校正;桌面/CLI/MCP 与 clips.json 状态一致);全渲染路径一致(连续剪、跳剪、多片段、高潮前置、字幕叠加与质检修复共享决定);单视频轨 SDR 的像素处理与安全直拷判定不变,多轨则显式选中同一画面并按所选轨隔离缓存,全程本地且无新模型/下载
v0.23.0(2026-08-30)「画面里写着什么,也应该成为证据」:屏显文字证据(复用已经开启的全场视觉扫描与候选复核,不装新 OCR、不增加模型调用;只保留可逐字确认的产品名、价格、比分、标题与 PPT 要点,不确定就留空);静态内容不漏(为低画面能量但有清晰文字的价格牌/PPT 保留证据席位,让带货、课程、评测的关键事实进入选段提示);结构化候选复核(实拍场景、画面分、标题匹配与屏显文字进入候选数据、CLI/MCP 输出和 clips.json,审阅台中英双语直接可见);封面更对题(AI 封面优先使用视觉复核观察到的真实场景,不再只靠转写钩子猜画面);沿用原有可选视觉开关,未开启时零额外成本、失败自动回退
v0.22.0(2026-08-30)「画面该救才救,正常素材一帧不乱动」:智能画面校正(桌面出片方案、CLI --auto-enhance 与 MCP 统一显式开启,默认关闭);片段级实测(复用已有 4fps Tier-0 解码采集亮度低位/均值/高位与饱和度,按跳剪或多片段最终保留的源时间单独统计,不新增模型和完整解码);克制有上限(只在证据充分且明显偏暗、发灰、过曝或过饱和时轻调亮度/反差/饱和度/gamma,正常素材不加滤镜,黑白素材不强行增艳);全链路一致(连续剪、跳剪和高潮前置使用对应窗口的校正,滤镜置于裁切缩放之后、字幕水印之前);可审计可复用(clips.json 记录测量、原因与精确调整,渲染缓存按派生方案区分,超长录播证据均匀有界)
v0.21.0(2026-08-30)「成片不只导出来,还要证明画面没坏」:冻结帧质检(同一次 FFmpeg 扫描识别持续 3 秒以上的异常静止画面,片尾冻结也能闭合记录);主体覆盖率(复用已有 YuNet 人脸采样,按最终竖屏裁窗统计未完整保留与严重出框帧,不新增模型扫描);镜头锁定修正(锁定构图真正保持到下一镜,不再缓慢漂向后续镜头);跳剪轨迹对齐(裁窗在删掉的源片区间前后瞬时衔接,不会隔着被删内容错误插值);冻结与构图属于需人工回放的语义告警,不会冒险自动重剪
v0.20.0(2026-08-30)「主体留在画里,镜头别乱跑」:舒适优先竖屏构图(逐镜头汇总所有可见人脸的安全包络,单人移动/多人对谈能装下就锁住机位,只有确实需要时才平滑跟随);居中吸附(原片已接近中心时尊重摄影构图,不制造无意义偏移);丢失回正(短暂漏检保持当前主体,持续 1.25 秒后平滑回到中心,不再长期守着空画面;无可靠人脸的新镜头立即居中);全链路回执(clips.json 记录镜头总数、锁定、多人锁定、跟随、回正与居中兜底数量,拼接片逐段聚合);不新增模型、不增加安装包体积,检测不足仍安全回退居中裁剪
v0.19.0(2026-08-28)「证据只算一次,下一刀更快更准」:本地多模态证据索引(源文件指纹、能力版本与模型共同定址,原子写入、损坏失效、最近使用淘汰,默认最多 64MB);九路证据链(新增无需模型的轻量运动峰值,与文本/响度/镜头/表情/视觉/弹幕/语气/笑声掌声共振);看得见的运动依据(工作台时间轴新增运动曲线,代表帧同时保留全场均匀覆盖);昂贵分析跨入口复用(Tier-0 信号、TransNetV2 镜头边界与可选 VLM 扫描在桌面、CLI、MCP、录播监听/webhook 间共享,模型或算法变化自动重算,API Key 不落盘);独立诊断与清理(证据索引与渲染/转写缓存互不误删,清理后二次生成即可恢复)
v0.18.0(2026-08-28)「质量看得见,升级有尺子」:逐词时间来源(原生/二遍对齐/内插/手工改稿/缺失估时,旧工程兼容);聚焦复核(逐句稿估时徽标与一键筛选,候选详情显示字幕时间回执);局部对齐报告(匹配覆盖、对齐/内插词数与不确定区间进入 clips.json);字幕质量门(无效时间、重叠、阅读速度、闪现、超宽词与估时区间按最终成片时间轴检查);可重复质量评测(本地黄金集命令输出 CER/WER、词边界误差和爆点 recall@K,不下载新模型);新增独立 dev:web 浏览器预览,清掉 Electron 运行包也能做 UI 回归
v0.17.0(2026-08-25)「长视频越剪越快」:有界基础渲染缓存(同源文件、切点、字幕/裁切/音频处理与品牌参数命中时直接复用,原子写入、损坏失效、最近使用淘汰,默认最多 1GB);安全智能直拷(仅 H.264 单连续片段、起点关键帧对齐且无画面滤镜时复制视频流,音频仍完整执行 AAC、边缘淡化、降噪、响度与敏感词静音,任何异常透明回退精确编码);全入口共享(桌面手动、录播监听/webhook、CLI 与 MCP 共用缓存);缓存诊断与清理(设置页双语显示占用,二次确认后只清可重复生成的基础成片,不碰项目、素材、模型和转写缓存)
v0.16.0(2026-08-25)「工程留得住,每一步都能回头」:项目工作区(多工程列表、切换、重命名、关闭、删除与媒体重连,源素材离线/变化不丢工程,旧会话自动迁移);可逆编辑历史(选片、标题/切点、手动加片、逐句稿纠错统一 undo/redo,60 步/4MB 双上限,随项目恢复);专业快捷键(播放/跳播/入出点/候选切换,输入框与弹窗安全让出);本地 A/B 实验中心(一片多版自动按平台建组,稳定内容 ID 关联指标,同平台/72 小时/最低样本门槛,只给谨慎的方向性判断)
v0.15.1(2026-08-24)「任务接得住,发完学得会」:硬件加速出片(VideoToolbox / NVENC / QSV 自动探测,失败透明回退 x264);真实表现中心(导入平台指标,高低表现模式回流选段);公开视频 URL 导入(B站 / YouTube 等地址,官方解析工具自动校验、断点续传);重启接着剪(素材、逐字稿、候选、勾选与手调切点恢复);持久自动化任务中心(录播监听 / webhook 共用队列,历史、取消、重试与中断状态落盘,不存凭据);敏感词音频静音(按逐字时间映射跳剪与多片段,字幕保留原文);发布反馈台账(稳定内容 ID、预填指标 CSV、保守匹配与待回填状态);桌面健康检查(工具、9 类模型、LLM、磁盘/缓存,核心模型准备可取消续传);主题系列整理(重复有效关键词自动分集,变体排除,附 manifest)
v0.15.0(2026-08-20)「向导退役、工作台上岗」:三栏工作台(三步向导退役——左栏素材与录播监听常驻,中央「源画面+竖屏 9:16 实时裁切+时间轴+候选密排表」,右栏候选详情与检测参数,全程一屏不跳页);时间轴上桌(全场响度曲线+弹幕热度曲线+胶片带缩略图,候选段直接画在曲线上,爆点落在哪一眼扫到);候选不怕退(候选与审阅状态进会话仓,切页返回不丢);显式重新检测(改检测参数不再静默重跑整轮,改完自己点「重新检测」);出片方案预设(33 个出片开关收进六组,默认出片/带货全家桶/极简省时三套方案一键切换);设置中心(散落七处的配置——AI 模型/转写引擎/导出与存储/品牌样式/热词词表/录播监听/语言——合并一页);弹幕这票投得更准——抖音直播录制弹幕 .jsonl 兼容(与 B 站录播姬 .xml 双格式自动发现,抖音主播的录播从此也有弹幕证据)、互动事件计权(SC/舰长/礼物/关注/点赞按档加权——花钱和动手的票比弹幕硬)、反刷屏(同一人单窗贡献封顶)、突发加成(相对前一窗跳升计分——爆点是「突然炸」)、信号融合升级(多路共振加成+内容自适应窗口)、弹幕引导采样(表情/语气这类贵模型的算力优先花在观众炸锅处);修复真机预览黑屏(多个 video 同载同一本地流 URL 在 Chromium 撞车)与胶片带缩略图被 CSP 拦截
variantOf,合集与 EDL 只收原版);音效打点与 BGM(whoosh 卡切缝、「叮」卡情绪峰、钩子上屏轻响,每条最多 3 个;BGM 循环铺满+人声闪避+结尾淡出,独立后处理趟零画质损失);动态极简字幕样式doctor 环境自检 + 模型下载断点续传 + 发布文案角度模板(8 钩子角度×5 CTA)+ 参考爆款入口补全| 里程碑 | 状态 |
|---|---|
| 桌面客户端 · 本地转写三档 · AI 找爆点 · 竖屏+字幕成片 · 舒适智能构图 | ✅ 已完成 |
| 说话人分离 · 气泡字幕 · 气口跳剪 · 一键全托管 · 安装包发布 | ✅ 已完成 |
| v0.5 ~ v0.9(审阅台 · MCP · 录播监听 · 质检修复 · 反馈回流 · 设置页) | ✅ 已发布 |
| v0.10 ~ v0.14(多片段拼接 · 品类判据 · 质量门三档 · 平台发布包 · 一片多版 · 剪映草稿 · 变形度评分 · AI 封面/配乐) | ✅ 已发布 |
| v0.15(三栏工作台 · 时间轴曲线 · 弹幕互动计权) | ✅ 已发布 |
| v0.15.1(硬件加速 · URL 导入 · 断点恢复 · 持久队列 · 发布反馈 · 健康检查 · 主题系列) | ✅ 已发布 |
| v0.16(项目工作区 · 可逆编辑 · 专业快捷键 · 本地 A/B 实验) | ✅ 已发布 |
| v0.17(有界渲染缓存 · 关键帧安全直拷 · 全入口共享 · 缓存诊断清理) | ✅ 已发布 |
| v0.18 ~ v0.27(质量评测 · 字幕质量门 · 多模态/屏显文字证据 · 舒适竖屏构图 · 成片质检 · 智能画面校正 · HDR 安全转 SDR · 同轨分析 · 质量封面 · 语音安全切点 · 48k 智能人声增强) | ✅ 已发布 |
| 英文 ASR 升级(Parakeet)· 代码签名 · 无人值守增强 | 🗺️ 规划中 |
完整更新历史见 Releases · 想投票决定先做哪个?到 Discussions 留言。
有什么免费的 AI 切片 / AI 剪辑软件? HotClip 就是——免费开源(AGPL-3.0)、本地运行的 AI 剪辑 / 视频切片工具,把长视频、直播回放一键切成竖屏短视频,无水印、无积分制、不限时长,Windows / macOS / Linux(实验)都有安装包。
直播回放 / 播客怎么一键剪成抖音、B站短视频? 导入文件 → AI 转写并自动识别高光片段(可手动增删调边界)→ 一键导出竖屏 9:16 成片,自带字幕、标题贴片和封面图,直接上传抖音 / 快手 / B站 / 视频号 / 小红书。
AI 剪辑会上传我的视频吗?需要联网吗? 不上传。转写、字幕、切片、导出全程在你自己的电脑上离线完成。只有「AI 找爆点」这一步默认调用云端大模型(只发文字稿,用你自己的 Key),接本机 Ollama 后 100% 离线。
能自动加字幕吗? 能。逐词同步的动态字幕直接烧进画面,关键词高亮/大字弹出/气泡特效等多款样式一档切换,也可导出 SRT 给平台原生上传;开双语字幕还能整句翻译烧成第二行。
能自动剪掉口播里的停顿和口头禅吗?视频如何去气口? 能。「剪气口」自动删掉说话间的静音停顿,「剪口头禅」剪掉嗯/呃与结巴重复——剪了什么逐条写进 clips.json,你始终知道 AI 动了哪里。
弹幕能参与选爆点吗?直播高光怎么找? 能,而且是最硬的证据。HotClip 自动发现录播旁的弹幕文件——B 站录播姬的同名 .xml、抖音直播录制工具的弹幕 .jsonl 都认;弹幕密度、SC / 舰长 / 礼物 / 关注 / 点赞互动直接进爆点判断(单人刷屏有封顶,突然爆发有加成)。没有弹幕文件也不要紧,响度 / 镜头 / 运动 / 表情 / 语气 / 笑声等信号照样兜底。
剪映可以自动切割片段吗?和 HotClip 怎么配合? 剪映的智能切片在会员档,且只能切连续区间。HotClip 免费开源、支持把相隔十几分钟的片段拼成一条,还能把每条切片导出成剪映草稿——AI 粗剪交给 HotClip,打开剪映接着精修,不冲突,是接力。
HotClip 和剪映 / OpusClip / Klap 这类工具的区别? 最大区别是素材不出你的电脑:OpusClip 等 SaaS 必须上传云端、按源视频分钟扣积分(积分月底清零),免费档带水印;剪映的智能切片等核心能力在会员档。HotClip 开源免费、本地处理、无水印、不限时长,AI 切点附理由可审计。详见上方对比表。
支持中文视频吗?方言、粤语呢? 支持且是强项。中文识别走专用引擎(SenseVoice/Paraformer/FireRedASR2),准确率显著高于通用模型;方言、粤语、中英混说都覆盖,界面、字幕、prompt 都针对中文内容做了适配。
需要显卡吗?配置要求高吗? 不需要。本地转写用 int8 量化小模型,普通 CPU 就能跑;找爆点的大模型在云端(或你本机的 Ollama)。
可以切别人的直播吗?直播切片如何申请授权? HotClip 面向你自己的内容或已获授权的切片。切别人的直播请先拿到授权(如各平台/公会的主播切片授权计划);未经授权的影视/直播搬运不受支持,也不欢迎。
首次使用,语音模型下载到 100% 又从头开始怎么办? 升级到 v0.9.1 或更新版本即可,老版本的 Windows 解压 bug 已彻底修复;旧版已下载的字节还会自动续传。
git clone https://github.com/xixihhhh/hotclip.git
cd hotclip
pnpm install
pnpm dev # 启动桌面应用(开发模式)
pnpm test # 跑单元测试
技术栈:Electron + React 19 + TypeScript + Tailwind 4 · ffmpeg(打包内置)· sherpa-onnx 本地转写 + 说话人分离 · libass 动态字幕 + 离屏 Chromium 气泡字幕引擎 · LLM 爆点检测(Atlas Cloud / Ollama / 任意 OpenAI 兼容接口,BYO Key)
| 项目 | 在 HotClip 中的角色 |
|---|---|
| sherpa-onnx | 本地语音识别运行时(纯 CPU 可跑) |
| SenseVoice / FunASR | 五语种快速转写 / Paraformer 中文转写与标点 |
| FireRedASR | 最高精度档:普通话/方言/中英混说 |
| pyannote-audio + 3D-Speaker | 说话人分离(本地零上传) |
| FFmpeg + libass | 帧精确切割 / 字幕烧录 |
| onnxruntime | 端侧模型推理 |
⭐ 觉得有用就点个 Star——Star + Watch 第一时间收到新版本通知,每颗星都是让更多人不用再给积分制付费的一票。
177 commits
TypeScript
99.3%