xixihhhh/hotclip

免费开源的 AI 剪辑 / 直播切片工具:长视频、直播回放、播客一键切成爆款竖屏短视频,直发抖音/快手/B站/小红书/视频号——AI 找高光金句、弹幕热度进爆点判断、自动加字幕、横屏转竖屏,本地运行无水印不上传 | Free open-source Opus Clip alternative, 100% local: AI clips long videos & livestream VODs into viral 9:16 shorts for TikTok & YouTube Shorts. No credits, no watermark, no uploads. Win/macOS/Linux.

166

stars

177

commits

TypeScript

primary language

Sep 5, 2026

updated

xixihhhh.github.io/hotclip/
ai
ai-clip-generator
auto-subtitles
bilibili
claude-skill
desktop-app
douyin
electron
livestream
local-first
long-video-to-shorts
mcp-server
opus-clip-alternative
podcast-clipper
short-form-video
speech-recognition
tiktok
video-clipping
video-editing
youtube-shorts

README

HotClip 爆款切片 — 本地 AI · 一键切片:长视频、直播回放一键切成爆款竖屏短视频

HotClip 爆款切片 — 免费开源的 AI 直播切片 / 视频剪辑工具

长视频、直播回放一键切成爆款竖屏短视频

简体中文 | English | 官网 | 下载 | FAQ | 反馈

最新版本 下载量 平台 License GitHub stars

AI 自动找爆点(附理由) · 横屏转竖屏 9:16 · 自动加动态字幕 · 去气口剪口头禅

无水印 · 无积分制 · 不限时长 · 素材不上传 · 连注册都不用

本地转写现支持分段保存、停止与续跑;逐句稿提供跨句全文搜索、长稿虚拟列表,以及可试听、确认和撤销的局部时间校准。导出自动改善不同语言的字幕阅读节奏。可选 Qwen3-ASR 本地服务与模型评估命令见 语音与长稿使用指南

导出与取消

导出页会显示素材检查、字幕翻译、文案生成、多版准备、编码和文件整理阶段。准备阶段即可取消,停止清理结束后可以直接重试;重复启动不会覆盖正在运行的任务。进度在文件整理完成前最高显示 99%。关闭烧录字幕、只打开 SRT 导出时,也会保留逐字稿供字幕文件使用。

常规剪切、跳剪、音频成片、合集与动态字幕编码先写目标目录内的独立临时文件,成功关闭编码器后才替换目标。失败或取消的这次编码不会把已有目标文件截断;同一批此前完成的切片保留。普通取消会清理临时目录;系统强制结束进程时可能留下隐藏的 .hotclip-write-* 目录,需在确认没有导出运行后再处理。这是逐次编码的文件保护,不是整批回滚。

为什么选 HotClip

  • 真免费,不是试用:开源 AGPL-3.0,无水印、无积分制、不限时长、无需注册——不存在「免费档阉割」,也没有月底清零的积分
  • 素材不出你的电脑:转写、字幕、剪辑、导出全程本地;未发布素材、客户内容不用交给任何云
  • AI 每一刀都有理由:爆款分 + 开场钩子 + 推荐理由 + 四维分项,切点逐字对齐;字幕时间来源与需复核区间也明确可见——AI 不猜时间戳,也不用虚构置信度替你做决定
  • 自动切点也会先听人声:不到 1MB 的本地语音检测给逐字时间再加一道独立证据;词间空隙仍有人声就不剪,开头结尾在严格上限内保护尾音,证据对不上时完全沿用原切点
  • 有底噪才开,而且能选档:基础档继续用温和固定滤镜;智能档首次下载约 10MB 的 48kHz 本地人声增强模型,在完整剪辑组装后、音效/BGM 混入前只处理讲话原声,不可用时自动回退基础档并在成片回执里说清楚
  • 弹幕直接进爆点判断:自动发现录播旁的弹幕文件(B 站录播姬 / 抖音录制都认),礼物 SC 点赞按互动计权、单人刷屏防伪——观众逐秒投的票,别家工具还没在看的证据
  • 切完就能发:竖屏成片 + 动态字幕 + 封面 + 发布文案 + 平台发布包一次出齐,抖音 / 快手 / B站 / 小红书 / 视频号逐平台整理好
  • 任务断了也接得上:重启自动恢复素材、逐字稿、候选与手调切点;录播监听和 webhook 共用持久任务队列,失败可重试、运行中可取消
  • 长期工程,不是一次性任务:项目工作区集中管理多份工程,源素材离线/变更会明确提示并可重连;标题、切点、勾选和逐句稿都能撤销/重做,重开项目后编辑历史仍在
  • 分析和成片始终看同一画面:多视频轨素材从运动/镜头、时间轴缩略图、表情与视觉复核到最终渲染都绑定同一条选中视频轨;PQ/HLG 的分析预览先安全转成 SDR,证据缓存也按画面与色彩决定隔离
  • 长视频越剪越快:完全相同的基础成片直接复用本地渲染缓存;H.264 单段在关键帧对齐且不改画面时只复制视频流,音频处理照常,条件不满足自动回退精确编码
  • HDR 手机素材不再盲转:PQ/HLG 且色彩信息完整、受支持的 HDR 视频自动安全转成社媒通用 SDR BT.709;路径不完整/不支持就保持既有渲染并明确提示,普通 SDR 不变
  • 画面只在确有必要时校正:可选的智能画面校正只测最终保留帧,明显偏暗、发灰或过饱和才克制修正;正常素材不乱动、黑白素材不强行增艳,不用上传也不新增模型
  • 发出去还会学习:每条成片有稳定内容 ID,导入播放/互动 CSV 后自动对账;一片多版自动形成本地 A/B 实验,只在同平台、同发布窗口、样本充足时给方向判断
  • 睡觉也在出片:录播监听 7×24 盯住录播姬 / OBS 目录,录完自动切;出片前一键健康检查,CLI / MCP 让 Agent 一句话交付

直播切片怎么做?三步出片

一条长视频变成多个爆款短片:AI 智能识别高光时刻,一键生成竖版爆款短视频

  1. 导入:把播客、直播回放、课程、Vlog 丢进来(MP4 / MKV / MOV / FLV / TS,纯音频也行),或直接粘贴 B站 / YouTube 等公开视频地址;首次自动下载并校验官方解析工具,源视频落到本机后进入同一套处理流程
  2. AI 找爆点:本地逐字转写 → AI 通读全文挑出金句、冲突、高能片段,每条附爆款分、开场钩子和推荐理由,切点精确到词;看不顺眼的取消勾选即可
  3. 一键出片:竖屏 9:16 成片直接导出——舒适构图、动态逐字字幕、标题贴片、响度归一,附封面图和发布文案,打开就能发抖音 / 快手 / B站 / 视频号 / 小红书 / TikTok

界面预览

专业工作台:预览 + 信号时间轴 + 候选列表 + 详情栏一屏工作

专业工作台 —— 预览、时间轴、候选表、详情栏一屏工作:弹幕/响度热度曲线直接画在时间轴上,候选段就落在峰上,「为什么选这段」一眼可见;每条候选附爆款分、四维分项与逐字精确切点,弱片自动标「不建议发布」,勾选取舍全在你手。

导入长视频
导入 播客 / 直播回放 / 课程 —— 全程本地处理,素材不上传
选择转写引擎
选转写引擎 —— 素材常驻工作台,三档本地(SenseVoice / Paraformer / FireRedASR2)+ 可选云端,隐私分级明标
逐字转写
逐句稿页签 —— 带时间戳、即点即改,点时间码画面直接跳过去;是找爆点和字幕的地基
一键出片
一键出片 —— 出片方案一键复用,竖屏成片直接发,附封面图与 clips.json 元数据

截图为真实界面(演示素材:一段带货直播回放)。觉得切得准,就点个 ⭐——每颗星都是让更多人不用再给积分制付费的一票,Star + Watch 还能第一时间收到新版本通知。

⬇️ 下载安装

去 Releases 页下载最新版 »

平台文件说明
Windows 安装版HotClip-x.y.z-win-x64.exe双击安装即用
Windows 绿色版HotClip-x.y.z-win-x64.zip免安装,解压即用
macOS(Apple 芯片)HotClip-x.y.z-mac-arm64.dmg拖进「应用程序」
Linux(实验性)HotClip-x.y.z-linux-x64.AppImagechmod +x 后运行;启动报 sandbox 错误加 --no-sandbox

⚠️ 当前版本未做代码签名:Windows SmartScreen 提示时点「更多信息 → 仍要运行」;macOS 首次打开用右键 → 打开(或到「系统设置 → 隐私与安全性」允许)。代码签名已在规划中。

不用 Python、不用 Docker、不用命令行——下载安装包双击即开。

谁在用:直播切片 · 切片带货 · 播客剪辑 · 口播剪辑

  • 主播 / 切片手(直播切片、录播切片):下播后把几小时直播回放自动切成高光短视频;开「录播监听」后 7×24 无人值守,录完自动出片;弹幕热度直接进爆点判断,B 站录播姬 .xml 和抖音直播录制的弹幕 .jsonl 都认
  • 带货 / 矩阵团队(切片带货,已授权):商品讲解模式按转化逻辑选段,一键全托管批量出片,每条附发布文案、封面图与 clips.json 元数据,120+ 违禁词规则发布前点名;一片多版出差异化包装、平台发布包按各平台规格整理齐套素材,多账号多平台拿起来直接发
  • 播客主(播客剪辑、播客视频化):纯音频也能出片——自动合成波形动画画面 + 金句字幕,播客节目直接变竖屏视频
  • 知识区 UP 主 / 口播博主(口播剪辑):自动去气口、剪口头禅、删停顿,长口播变利落短视频,字幕逐字点亮

和 OpusClip、剪映智能切片的区别

市面上的 AI 切片工具,要么按分钟扣积分(一期 2 小时播客烧光整月额度,积分月底还清零),要么必须上传云端(未发布素材/客户内容不敢传),要么切点稀烂、中文支持名不副实;开源侧则几乎全是命令行,小白装不起来。HotClip 把两边的坑同时填上:

HotClipOpusClip / Klap / Vizard 等 SaaS剪映/CapCut 智能切片FunClip / autoclip 等开源
价格免费开源$15-29+/月,按源视频分钟扣积分,积分月底清零核心功能进会员/Pro免费
素材去向全程本地,不上传必须上传云端云端处理为主本地
水印/时长限制免费档有水印、限时长、项目 3 天过期部分模板有限制
账号无需注册需注册,退订删项目需登录
小白可用双击安装即用网页版,易用易用命令行/Docker/自部署
切点质量逐字对齐精确到词,附理由可否决黑盒打分,常被抱怨断章取义黑盒按句切,无爆点排序
竖屏字幕9:16 重构 + 逐字点亮字幕内置有(付费档)自动字幕已进付费多数无竖屏重构

竞品信息核对于 2026-07,具体以各家官网为准。详细英文对比:HotClip vs OpusClip

功能一览

「导入 → AI 找爆点 → 竖屏+逐字字幕成片」三步全流程可下载可用。每组点开看细节——细节里全是真功能,不是形容词。

🎙️ 本地转写:三档引擎,逐字时间戳

已有原文字幕时,在转写页点击 导入字幕,选择与当前素材对齐的 UTF-8 SRT / WebVTT,即可进入逐句稿、纠错和文字选段;需要 AI 分析时再点击检测。导入本身不运行 ASR,也不覆盖已有转写缓存。保留字幕原句时间,句内字词时间明确标记为估算,可通过「需复核」筛选检查;手动拼接严格遵守选段边界。

CLI 的 transcribehighlightsclip 均支持 --subtitles "/path/original.srt",三个 MCP 工具均支持 subtitlePath。例如 pnpm cli transcribe "/path/video.mp4" --subtitles "/path/original.vtt" --json 可输出带时间来源的结构化逐句稿。支持单轨原文字幕,最大 5 MB、20,000 段、100,000 字词;重叠、乱序、超出素材时长或带流媒体时间映射的字幕会提示修正后再导入,不会静默丢句。

快速 SenseVoice(五语种,170MB)/ 均衡 Paraformer(中文更准)/ 最准 FireRedASR2(普通话/方言/中英混说)——全部本地运行、普通 CPU 就能跑,首次自动下载(国内镜像优先、断点续传);另有云端档 ElevenLabs(自带 Key,只上传音轨)。

展开细节:转写缓存 · 逐句稿即点即改 · 热词词表 · 说话人分离
  • 转写结果本地缓存:同一个文件下次再开、换设置多切几条,跳过重转写秒进挑爆点;文件改动或换引擎自动失效
  • 逐句稿即点即改(转写纠错):每句 hover 出铅笔当场改,字幕、双语翻译、发布文案全用修正后文本;重建的逐词时间会明确标「估时」,可一键只看需复核句
  • 热词词表(专有名词一次纠错,期期自动修正):人名/品牌/术语改一处,一键应用到全片同错句并入词表;之后每次转写自动整词替换,词表更新后同素材直接用缓存重放、不重跑识别
  • 多人对谈「谁在说话」:一键说话人分离(本地 pyannote + 3D-Speaker,零上传),逐句标注谁在说;AI 按说话人挑段不断章取义,气泡字幕按人上色

🔥 AI 找爆点:九路证据链,每一刀都有理由

LLM 只负责«挑哪段»并引用原文,时间戳由逐字转写反向对齐——不让 AI 猜时间。每条候选附爆款分、开场钩子、推荐理由与四维分项,弱片自动标「不建议发布」。

展开细节:复评质量门 · 弹幕/表情/视觉信号 · 画面复核 · 参考爆款 · 省钱漏斗 · 商品模式
  • AI 复评质量门:严格评审员二次盲评,钩子/结构/价值/热点四维分项打分,每维一句话理由,另给一条可烧上片头的悬念句
  • 爆款分=排名不是玄学:四维加权后按候选间相对排名归一(推荐档 76-99),同批次可直接比大小,不受批间漂移影响
  • 画面声音证据:响度峰值、镜头切换密度与轻量运动峰值本地采集注入判断;工作台时间轴直接显示运动曲线,不再纯文本盲选
  • 弹幕热度信号(B 站 / 抖音双格式):自动发现录播旁的弹幕文件——录播姬同名 .xml、抖音直播录制的弹幕 .jsonl 都认;滑窗密度+高能词加权圈出观众实时高能段,SC/舰长/礼物/关注/点赞按互动档另计权(花钱和动手的票比弹幕硬);同一人刷屏有贡献封顶(一个人刷一百条不算全场沸腾),突然爆发另有加成——观众逐秒投的票,证据力最强
  • 信号共振与算力聚焦:多路信号同秒共振才可信——只有音量高可能是 BGM,只有弹幕高可能是刷屏,音量+弹幕+笑声一起亮才是真爆点;运动峰与均匀全场覆盖共同引导抽帧,避免前半段热闹画面挤掉后半段安静但重要的场景
  • 本地多模态证据索引:响度/镜头/运动、TransNetV2 边界与可选视觉扫描结果按「源文件指纹 + 能力版本 + 模型」原子落盘;桌面、CLI、MCP、录播监听与 webhook 复用同一份结果。默认最多 64MB、最近使用淘汰,损坏或配置变化自动重算,视觉 API Key 从不写入索引
  • 表情峰值信号:YuNet + FER+(几 MB 的 MIT 协议模型)找大笑/惊讶/激动峰值,零配置让 AI「看见」情绪爆点
  • 视觉爆点信号(可选):新用户默认预填本机 Ollama qwen3.5:4b,一个多模态模型同时处理文字与九宫格接触表,研判画面高能时刻,专治逐字稿里看不见的画面梗;端点不可用自动跳过,不会挡住纯文字找爆点
  • AI 画面复核(可选):检测后对头部候选再抽九宫格让视觉模型过目——画面炸裂加分、信号候选画面死气降分、画面与标题货不对板标警告,看点写进推荐理由;本机 Ollama 免费,视觉设置填 API Key 即切云端模型
  • 参考视频驱动:丢一条想对标的爆款切片,本地实测节奏生成风格画像,选段向对标靠拢(CLI --reference)
  • 审阅反馈回流:你采用/否决的候选自动落进本地偏好档,下次「同类优先/同类少选」,越用越懂你;偏好数据不出本机
  • 真实数据反哺选段:把平台导出的 CSV/JSON 播放与互动数据交给 pnpm cli feedback,HotClip 在本机归纳高/低表现内容的题材、钩子与时长共性;桌面端/CLI/MCP/录播监听下一轮找爆点都会参考真实观众结果,不照抄旧标题、不上传账号数据
  • 端侧两级漏斗(省钱):本机小模型先初筛,云端只精读入围段——长视频云端 token 花费降一个量级,切点精度零损失
  • 镜头切点吸附:TransNetV2 本地检测真实镜头边界,切点自动吸附(词边界守卫绝不切掉说话)
  • 商品讲解模式(带货直播切片):填商品词,按「试用实测 > 卖点 > 价格机制」转化逻辑选段;纯憋单拉互动段(平台判违规)明确排除
  • 切片时长档:短·10-30s / 标准·8-40s / 长·40-90s 一键切换重选段,目标时长作为硬约束进提示词

📝 字幕与文案:自动加字幕、发布文案一步到位

动态字幕多款样式一档切换——关键词高亮、大字弹出、气泡特效、动态极简——词级时间戳驱动、语义断行不拦腰截断,SRT 可导出、双语可选;AI 起的爆款标题自动烧进顶部贴片,发布文案带标签生成。

展开细节:气泡特效字幕 · 开场钩子 · 双语 · Hormozi 大字 · 违禁词 lint · AIGC 标识
  • 语义断行(免 Key):顺着标点在真实子句处换行,长句无标点时回看结构助词断行——等价于头部项目用 LLM 插 [br],但零额外调用
  • 气泡特效字幕(Web 渲染引擎):内置 Chromium 离屏逐帧渲染 CSS 字幕层——自适应圆角气泡底、关键词渐变金字、弹性入场,libass 做不出的效果一档切换
  • 开场钩子(黄金3秒):AI 写的悬念句自动大字烧在开头 2 秒上三分之一,淡入淡出避开主体;没写出悬念句自动不加
  • Hormozi 大字爆点字幕:带货营销风,特大加粗、硬阴影、逐词点亮
  • 说话人标签字幕:多人对谈时换人行首自动加彩色「A:」「B:」标签(与气泡字幕按人上色同一套色板),观众一眼分清谁在说
  • 双语字幕(出海一步到位):整句语境翻译烧成副轨,中文源自动译英;跳剪压缩时译文行同步重映射
  • SRT 字幕文件导出:时间轴已对齐跳剪/剪口头禅后的成片,断行与烧录字幕一致
  • 发布文案生成:每条切片生成钩子风标题 + 3-6 个垂类标签 + 简介,落 .post.txt 与 clips.json;8 种钩子角度 × 5 类 CTA 可选
  • 平台违禁词 lint:120+ 本地规则扫标题/文案/字幕,绝对化用语/医疗宣称/导流话术发布前点名,零上传
  • AIGC 标识(合规内建):按《人工智能生成合成内容标识办法》一键打标——显式画面标识 + 隐式元数据标识

🎬 成片质量:像人剪的,不是机切的

舒适优先智能取景、气口跳剪、剪口头禅、响度归一 -14 LUFS、帧精确切割——制作链一步到位,每条切片出片后还有自我质检。

展开细节:横屏转竖屏 · 去气口 · 降噪 · 音效 · BGM · 质检自修复 · 智能封面 · 高潮前置 · 爆点闪现 · 精准切点
  • 舒适优先智能取景(横屏转竖屏 9:16):逐镜头汇总所有可见人脸;单人移动或多人同框只要能安全装进竖屏就锁住机位,避免追脸晃动。确实超出画幅才平滑跟随,短暂漏检先保持、持续丢失自动回正,无人脸回退居中裁剪
  • 构图回执:clips.json 记录每条成片锁定/多人锁定/跟随/丢失回正/居中兜底的镜头数;镜头锁定会保持到下一次切镜,跳剪也不会让裁窗穿过被删区间
  • HDR 安全转 SDR(自动):输入需同时具备 PQ(ST 2084)或 HLG 传递、BT.2020 原色、BT.2020 非恒定亮度矩阵与 TV/PC 范围,才会先在线性光域克制映射高光,再输出电视范围 SDR BT.709;有 MaxCLL / mastering 峰值时用于约束高光,缺失则交给 FFmpeg 安全估计。连续剪、跳剪、多片段、高潮前置、Web 字幕与质检修复走同一决定。检测到 HDR 但色彩路径不完整/不支持时不猜测、不套用 SDR 域智能校正,完成结果会提示未转换;若色彩信息检查本身失败,同样停用 SDR 域智能校正并明确提示检查失败;普通 SDR 沿用原路径。不新增模型、下载或上传,源色彩信息与决定写入 clips.json
  • 智能画面校正(可选,默认关):复用本地 Tier-0 分析,按每条最终保留片段测量亮度、反差与饱和度;只对证据充分且明显偏暗/发灰/过饱和的画面做有硬上限的轻校正,正常素材保持原样、接近黑白的素材不强行增艳。跳剪、多片段与高潮前置分别按真实保留窗口计算,具体测量和调整进入 clips.json
  • 去录屏UI:手机直播录屏的状态栏/固定UI/黑边,时域方差自动检测裁除
  • 语音感知气口跳剪(自动去气口):剪掉停顿静音并拼接,字幕时间轴同步重映射;「无词 + 声学静默 + 本地语音检测无人声」三重判定,ASR 漏词、轻声尾音、笑声掌声都不会被当空白误删;可选保留 0.25 秒呼吸口——节奏紧凑但不窒息。手调/拼接外边界不改,模型或证据异常精确回退旧逻辑
  • 剪口头禅:嗯/呃、结巴重复自动剪除(词表刻意保守),剪了什么逐条写进 clips.json
  • 响度标准化:每条按 EBU R128 归一到 -14 LUFS 社媒标准,整批音量一致;跳剪后按拼接后音轨计算
  • 双档人声降噪(显式开启):基础档沿用双高通 + 温和谱减;智能 48k 档首次按需下载约 10MB、经 SHA-256 校验的 DPDFNet2 本地模型,按声道分块增强最长 180 秒成片,视频流直拷。模型、下载或推理异常自动回退基础档;完成页与 clips.json 区分“智能生效 / 已回退 / 未应用”,字幕和逐字稿不改
  • 音效打点:whoosh 卡多段拼接/高潮前置的硬切缝、「叮」卡全片情绪最高点、开场钩子上屏轻响——规则打点每条最多 3 个宁缺毋滥;音效本地合成零素材零版权,想换真实音效包替换同名 wav 即可
  • 背景音乐(BGM 闪避):选个本地音频自动循环铺满全片,音量压在人声之下、说话时自动闪避、结尾淡出;混音是独立后处理趟,视频流直拷零画质损失
  • 出片自我质检 + 自我修复:黑屏/长静音/冻结帧/主体出框/响度/时长/切点半词复核写进 clips.json;冻结和构图问题只提醒回放核对,可安全自愈的告警才当场修复,修完重检变好才采纳
  • 高潮前置(cold-open):最炸的钩子句自动剪到开头再接正片——完播率手法,商业工具锁在付费档;定位失败自动跳过,宁可不做不可做错
  • 爆点闪现(flash-forward):正片开始前先闪 0.3-1 秒全片最炸瞬间再切回——悬念开场手法(全网仅 0.04% 切片有 visual hook);与高潮前置自动二选一,定位失败自动跳过
  • 精准切点(Paraformer 二遍对齐):导出前对选中片段二遍解码,一体化词级时间戳修正字幕、跳剪与切点;对齐词/内插词、匹配覆盖率与不确定区间写进回执,低匹配或异常仍自动回退
  • 字幕时间质量门:按最终跳剪/拼接后的真实时间轴检查重叠、无效时间、阅读速度、闪现短句、超宽词与估时区间;结果随每条成片写入 clips.json,问题可定位而不是只报一个“失败”
  • 质量排序智能封面:响度峰先提名有内容的时刻,再在最终成片上本地比较清晰度、信息量、曝光、明暗跨度与转场稳定性;黑白场/模糊过渡帧先淘汰,一片多版按排名取不同封面,探测失败原样回退旧响度峰
  • 帧精确切割:快速定位+重编码,爆点第一秒不糊不偏;数小时 FLV/TS 直接进
  • 硬件加速出片:自动探测随包 ffmpeg 支持的 VideoToolbox / NVENC / QSV,H.264 重编码优先走 GPU;设备或驱动临时不可用会透明回退 x264,不拿速度换可靠性
  • 导出可取消 + 实时进度:ffmpeg 进度流式回报,随时一键取消,已完成切片保留

🧰 审阅与工作流:AI 粗剪,人终剪

导出前应用内看片微调:切片审阅台(波形时间轴拖手柄逐词调切点)、字幕安全区预览(九平台真实遮挡遮罩)、出片偏好记忆、品牌样式模板。

展开细节:项目工作区 · 可逆编辑 · 断点恢复 · 审阅台 · 安全区 · 发布包 · 主题系列 · 一片多版 · 品牌模板 · 双画幅 · 合集 · EDL · 设置页
  • 项目工作区:多份剪辑工程集中管理,切换/重命名/关闭/删除互不串档;源素材缺失或被改动时保留工程并明确标记,重新选择文件即可安全重连,删除工程绝不删除素材
  • 可逆编辑 + 专业快捷键:选片、标题/切点、多片段调整、手动加片和逐句稿纠错都支持撤销/重做,历史随项目保存且有容量保护;空格/K 播放、J/L 前后 5 秒、I/O 设入出点、[/] 切换候选,输入框和弹窗中自动让出
  • 重启接着剪:当前素材、逐字稿、候选、勾选结果与手调切点自动保存;重开应用校验源文件后恢复到最后稳定状态,检测中/导出中等临时状态不会被错误复活
  • 切片审阅台:应用内直接播放候选,波形时间轴拖两端手柄逐词微调(自动吸附字词边界),一键还原 AI 切点;手调过的切点导出时机器不再改人的决定
  • 字幕安全区预览:一键叠加平台 UI 遮挡遮罩(抖音/快手/B站竖屏/视频号/小红书/TikTok/Reels/Shorts + 通用并集九档,按实测数据画)
  • 平台发布包(切完就能发):导出后按平台整理齐套素材到「发布包/」——每平台一个文件夹:视频(硬链接不占双份磁盘)+ 按平台画幅重裁的封面(小红书 3:4、B站 16:10、视频号 6:7)+ 按平台上限适配的文案(小红书标题硬截 20 字、话题数各按平台建议),manifest 记录适配了什么;打开文件夹逐平台上传即可
  • 主题系列自动整理:同场至少两条原版成片共享关键词时,按源片时间整理到「系列/主题/」并编号,附机器可读 manifest;变体不会被误当成剧集,视频仍优先硬链接不重复占空间
  • 一片多版(多账号真差异):同一切片一次出 2-3 版差异化包装——不同钩子角度的贴片标题、开场悬念句、发布文案,封面自动抓下一个响度峰;多账号分发靠增量价值,不做抽帧/镜像那类已被平台判搬运的像素级去重
  • 品牌样式模板:主高亮色/字幕字号位置/logo 水印配一次存成预设,每条切片自动带上;用了什么写进回执
  • 一键双画幅:同批切片竖屏之外再出一版横屏(自动去标题贴片、字幕换底部布局),竖版发抖音、横版发B站一次搞定
  • 精华合集一键成片:整批切片流复制拼接成合集(秒级零损),附章节时间戳,B站/YouTube 周更形态现成
  • 时间线 EDL 导出:timeline.edl(CMX3600)含跳剪的每一刀,导入 DaVinci / Premiere 重链源片继续精修
  • Audiogram 音频成片:纯音频源自动合成深色底+品牌色波形动画画面,播客也有「画面」
  • 出片偏好记忆 + 标题即点即改:开关组合自动记住;候选标题点铅笔就改,文件名/贴片/文案全跟着走
  • 设置页:模型存放位置可见可搬家(跨盘走「复制→校验→才删原件」)、导出画质三档(省空间档体积小 66%)、默认字幕样式与导出位置
  • 新版本提示:启动静默检查,有新版页头亮小徽标;断网全静默

🛡️ 发布合规:发得出去、活得下来

2026 年的分发环境:像素级搬运判定、AIGC 强制标识、收藏率权重——切得好只是一半,这组功能管另一半:发出去不被判搬运、被质疑时拿得出证据。

展开细节:变形度评分 · AI 封面 · AI 配乐 · 剪映草稿 · 台账留证 · AIGC 标注 · 反指纹多版
  • 变形度评分:本次导出实际做的变形(取景/跳剪/字幕/贴片/音效…)汇总成一个分,出片前实时预估,低于 40 黄牌提醒——像素级搬运是 2026 判搬运第一死因
  • AI 封面双档(可选):按切片标题生成竖版大字封面,走量档约 ¥0.3/张、精品档约 ¥1/张(复用 Atlas Key);与抓帧封面并存,想用哪张用哪张
  • AI 配乐(可选):按直播品类生成版权安全的纯音乐 BGM,自动挂进人声闪避混音链——商用曲库的版权风险归零
  • 剪映草稿导出:每条切片落一个剪映草稿文件夹,AI 的每一刀都铺在时间轴上——粗剪交给 HotClip,精修进剪映接力,不从零开始
  • 发布反馈台账:每条成片登记稳定内容 ID 与发布状态,一键生成待回填指标 CSV;导入真实播放/互动后按 ID 或唯一标题保守对账,未匹配/歧义行明确列出,表现规律回流下一轮选段
  • 本地 A/B 实验中心:一片多版自动按原候选、导出批次和平台建对照组;只比较同平台、72 小时内发布、每版至少 500 播放且数据齐全的版本,区分等待/证据不足/差异不明显/方向性领先,明确不作单变量因果承诺
  • 分发留证包:每条切片对应的源片区间落 CSV 台账,可选保存前后 3 分钟源片切段——授权切片被质疑搬运时,证据链拿得出手
  • 敏感词音频静音(可选):按逐字稿时间把自定义词表对应的音频静音,跳剪与多片段拼接后仍精确映射;字幕和逐字稿保留原文,便于审阅与追溯
  • AIGC 标注助手:按平台给标注文案与操作入口指引,一键复制;单场超 5 条提示限产(2026 算法偏好质量不偏好数量)
  • 多版反指纹:一片多版的末版自动换爆点闪现开场 + 模板种子化微扰(字号/基线/边距各有细微差异)——多账号分发不撞视觉指纹,且全部是真差异不是像素伪原创

🤖 批量与生态:CLI / MCP / Agent Skill

一键全托管(导入后点一个按钮全自动出片)+ 录播监听 7×24 无人值守 + Headless CLI + 本地 MCP Server——唯一本地不上传的切片 Agent 工具链

展开细节:持久任务队列 · 录播监听 · 健康检查 · CLI · MCP · Claude Code 技能
  • 持久任务中心:录播监听与 webhook 共用单并发队列,任务阶段、历史与重试次数落盘;可取消、可手动重试,应用重启后运行中任务标记为「已中断」而不是偷偷续跑,凭据从不写进历史

  • 长视频性能层:相同源文件、切点与基础效果重复导出时直接复用本地基础成片;H.264 连续片段仅在起点确认对齐关键帧且没有画面滤镜时直拷视频,音频仍执行淡化、降噪、响度和敏感词静音,失败透明回退精确编码。缓存按最近使用自动限制在 1GB,设置页可查看并单独清理

  • 录播监听(7×24 无人值守):盯住录播姬/OBS 输出目录,新录播落稳自动转写→找爆点→出片;「连续两轮大小不变」才算录完绝不切半截

  • 桌面健康检查:设置页一键检查 FFmpeg/FFprobe、解析工具、11 类模型、LLM 连通/鉴权/路由、磁盘、转写缓存、渲染缓存与多模态证据索引;缺少核心模型时显式准备,支持取消与断点续传;1GB 渲染缓存与 64MB 证据索引可分别安全清理

  • Headless CLI(与桌面端产物完全一致):

    pnpm cli transcribe 直播回放.mp4                 # 端侧逐字转写(带缓存)
    pnpm cli highlights 直播回放.mp4 --json          # AI 爆点候选,先审后剪
    pnpm cli clip 直播回放.mp4 --max-clips 10 --smart-denoise  # 全托管 + 48k 智能人声增强
    pnpm cli feedback bilibili.csv                   # 导入真实播放/互动表现
    pnpm cli feedback-report                         # 查看已学到的高/低表现模式
    pnpm cli doctor --download                       # 环境自检 + 预下载模型
    
  • 本地 MCP Server:Claude Code / Claude Desktop 注册后,一句「把这个 4 小时录播切 10 条爆点」就是完整交付;三个工具 clip_video / detect_highlights / transcribe_video

    {
      "mcpServers": {
        "hotclip": {
          "command": "npx",
          "args": ["-y", "tsx", "src/mcp/server.ts"],
          "cwd": "/path/to/hotclip",
          "env": {
            "HOTCLIP_LLM_BASE_URL": "http://localhost:11434/v1",
            "HOTCLIP_LLM_MODEL": "qwen3:8b"
          }
        }
      }
    }
    
  • 官方 Agent Skill:把这段话直接粘给 Claude Code / Codex,Agent 会自己完成安装:

    请安装 HotClip 作为我的本地切片技能:git clone https://github.com/xixihhhh/hotclip.git && cd hotclip && pnpm install,然后把 skills/hotclip/ 复制到我的 Agent skills 目录(Claude Code 为 ~/.claude/skills/hotclip/),并按 skills/hotclip/SKILL.md 里的说明配置 LLM 环境变量。装好后用一段测试视频跑 pnpm cli highlights 验证。

  • clips.json 处理回执:每条片 AI 动了什么(字幕样式/取景模式/跳剪比例/语音证据覆盖与保护剪口/对齐覆盖/字幕质检/封面选择模式与得分/剪了几个口头禅)一目了然,可审计,矩阵管线直接取用

  • 质量黄金集:pnpm quality:eval [fixture.json] 本地输出 CER/WER、词边界中位/P95 误差与爆点 recall@3/@5;以后换模型、调阈值先跑同一套样本,质量变化有数可查

  • 本地视觉模型对比入口:HOTCLIP_VISION_MODELS=qwen3-vl:4b,qwen3.5:4b pnpm quality:eval:vision 用同一批演示片、同一套九宫格与结构化解析比较成功率、耗时和画面证据;模型由你的 Ollama 管理,HotClip 不捆绑数 GB 权重

  • 模型自带干粮也行:默认本地免费模型;更强的爆点判断可一键接 Atlas Cloud、fal.ai 或任意 OpenAI 兼容接口,或本机 Ollama 完全离线

最近更新

v0.28.0 (2026-09-05):字幕导入与长稿编辑(SRT / WebVTT、跨句搜索、局部校准预览与撤销);本地语音续跑(分段保存、停止恢复、可选 Qwen3-ASR);字幕阅读节奏优化更可靠的导出(准备阶段取消、安全写入、直接重试、仅导出 SRT)。完整发布说明

v0.27.0(2026-08-31)「先把人声听清,再谈包装」:48kHz 智能人声增强(显式智能档首次按需下载约 10MB、SHA-256 校验的 DPDFNet2,按声道分块处理完整剪辑,视频流直拷);发布链路顺序正确(在高潮前置/多片段组装之后、音效与 BGM 混入之前处理原声,响度在增强后统一,避免把包装层当噪声);可用性优先(模型、下载、解码或推理异常自动回退原有基础降噪,关闭/基础档行为不变,完成页与 clips.json 如实记录智能生效/回退/跳过);端侧多模态预设升级(新用户本地视觉端点默认 qwen3.5:4b,文字与接触表共用同一模型,并新增可复现的本地 VLM 对比命令);桌面、CLI 与 MCP 共用同一档位语义,真实官方模型 48k 冒烟与 FFmpeg 集成回归通过

v0.26.0(2026-08-31)「切得更紧,但一个尾音也不赌」:本地语音活动证据(复用现有 sherpa-onnx 原生运行时,新增经 SHA-256 校验的 629KB 模型,不装 Python、不上传音频);安全外边界(只在语音与逐字时间相互印证时,于 0.6 秒硬上限内保护开头/结尾尾音并约束后续镜头吸附,手调与拼接外边界不动);三重跳剪门(无词、低峰值且 VAD 无人声才删,ASR 漏掉的轻声/短词会保留);多音轨一致(语音与响度证据显式读取最终渲染选中的同一条音轨);可审计回退(clips.json 记录覆盖率、边界位移与保护剪口,长区间/低覆盖/模型或解码失败完全回退既有行为);真实带前后静音语音样片与多音轨 FFmpeg 回归通过

v0.25.0(2026-08-30)「分析看对画面,封面挑对一帧」:全分析链路同轨(运动/镜头/画面统计、TransNetV2、表情抽帧、VLM 接触表、候选复核、时间轴胶片带、去录屏 UI 与人脸取景全部绑定最终渲染选中的全局视频轨);HDR 分析预览(仅对元数据完整且可执行的 PQ/HLG 路径先做同款 SDR 预览再缩放/取样,普通 SDR 与不完整 HDR 保持既有 fail-open 行为);缓存不串画面(Tier-0、镜头与视觉证据按选中轨和色彩计划版本隔离);质量排序封面(响度峰与均匀时刻共同提名,在最终 QA 后成片上用捆绑 FFmpeg 淘汰黑白场、低信息/模糊与不稳定过渡帧,变体取下一名,失败精确回退旧时刻);无新增模型、依赖、下载、上传或云端费用,真实双视频轨 PQ 样片与四场景封面黄金集进入回归

v0.24.0(2026-08-30)「HDR 色彩不靠猜,能安全转才转」:严格元数据门(读取像素格式、位深、原色/传递/矩阵/范围与可用的 MaxCLL / mastering 峰值;PQ/HLG 还需完整且经捆绑运行时验证的 BT.2020 非恒定亮度色彩路径才转换,不凭 10-bit 或 BT.2020 单项猜测);受控转成 SDR BT.709(显式输入色彩→线性化→保色优先 Mobius tone map→10 到 8-bit 误差扩散抖动,最后写入 TV-range BT.709 标签);异常也不藏(HDR 路径不完整/不支持时提示未转换,色彩检查失败时单独提示检查失败,两者都禁用不适用的 SDR 域智能校正;桌面/CLI/MCP 与 clips.json 状态一致);全渲染路径一致(连续剪、跳剪、多片段、高潮前置、字幕叠加与质检修复共享决定);单视频轨 SDR 的像素处理与安全直拷判定不变,多轨则显式选中同一画面并按所选轨隔离缓存,全程本地且无新模型/下载

v0.23.0(2026-08-30)「画面里写着什么,也应该成为证据」:屏显文字证据(复用已经开启的全场视觉扫描与候选复核,不装新 OCR、不增加模型调用;只保留可逐字确认的产品名、价格、比分、标题与 PPT 要点,不确定就留空);静态内容不漏(为低画面能量但有清晰文字的价格牌/PPT 保留证据席位,让带货、课程、评测的关键事实进入选段提示);结构化候选复核(实拍场景、画面分、标题匹配与屏显文字进入候选数据、CLI/MCP 输出和 clips.json,审阅台中英双语直接可见);封面更对题(AI 封面优先使用视觉复核观察到的真实场景,不再只靠转写钩子猜画面);沿用原有可选视觉开关,未开启时零额外成本、失败自动回退

v0.22.0(2026-08-30)「画面该救才救,正常素材一帧不乱动」:智能画面校正(桌面出片方案、CLI --auto-enhance 与 MCP 统一显式开启,默认关闭);片段级实测(复用已有 4fps Tier-0 解码采集亮度低位/均值/高位与饱和度,按跳剪或多片段最终保留的源时间单独统计,不新增模型和完整解码);克制有上限(只在证据充分且明显偏暗、发灰、过曝或过饱和时轻调亮度/反差/饱和度/gamma,正常素材不加滤镜,黑白素材不强行增艳);全链路一致(连续剪、跳剪和高潮前置使用对应窗口的校正,滤镜置于裁切缩放之后、字幕水印之前);可审计可复用(clips.json 记录测量、原因与精确调整,渲染缓存按派生方案区分,超长录播证据均匀有界)

v0.21.0(2026-08-30)「成片不只导出来,还要证明画面没坏」:冻结帧质检(同一次 FFmpeg 扫描识别持续 3 秒以上的异常静止画面,片尾冻结也能闭合记录);主体覆盖率(复用已有 YuNet 人脸采样,按最终竖屏裁窗统计未完整保留与严重出框帧,不新增模型扫描);镜头锁定修正(锁定构图真正保持到下一镜,不再缓慢漂向后续镜头);跳剪轨迹对齐(裁窗在删掉的源片区间前后瞬时衔接,不会隔着被删内容错误插值);冻结与构图属于需人工回放的语义告警,不会冒险自动重剪

v0.20.0(2026-08-30)「主体留在画里,镜头别乱跑」:舒适优先竖屏构图(逐镜头汇总所有可见人脸的安全包络,单人移动/多人对谈能装下就锁住机位,只有确实需要时才平滑跟随);居中吸附(原片已接近中心时尊重摄影构图,不制造无意义偏移);丢失回正(短暂漏检保持当前主体,持续 1.25 秒后平滑回到中心,不再长期守着空画面;无可靠人脸的新镜头立即居中);全链路回执(clips.json 记录镜头总数、锁定、多人锁定、跟随、回正与居中兜底数量,拼接片逐段聚合);不新增模型、不增加安装包体积,检测不足仍安全回退居中裁剪

v0.19.0(2026-08-28)「证据只算一次,下一刀更快更准」:本地多模态证据索引(源文件指纹、能力版本与模型共同定址,原子写入、损坏失效、最近使用淘汰,默认最多 64MB);九路证据链(新增无需模型的轻量运动峰值,与文本/响度/镜头/表情/视觉/弹幕/语气/笑声掌声共振);看得见的运动依据(工作台时间轴新增运动曲线,代表帧同时保留全场均匀覆盖);昂贵分析跨入口复用(Tier-0 信号、TransNetV2 镜头边界与可选 VLM 扫描在桌面、CLI、MCP、录播监听/webhook 间共享,模型或算法变化自动重算,API Key 不落盘);独立诊断与清理(证据索引与渲染/转写缓存互不误删,清理后二次生成即可恢复)

v0.18.0(2026-08-28)「质量看得见,升级有尺子」:逐词时间来源(原生/二遍对齐/内插/手工改稿/缺失估时,旧工程兼容);聚焦复核(逐句稿估时徽标与一键筛选,候选详情显示字幕时间回执);局部对齐报告(匹配覆盖、对齐/内插词数与不确定区间进入 clips.json);字幕质量门(无效时间、重叠、阅读速度、闪现、超宽词与估时区间按最终成片时间轴检查);可重复质量评测(本地黄金集命令输出 CER/WER、词边界误差和爆点 recall@K,不下载新模型);新增独立 dev:web 浏览器预览,清掉 Electron 运行包也能做 UI 回归

v0.17.0(2026-08-25)「长视频越剪越快」:有界基础渲染缓存(同源文件、切点、字幕/裁切/音频处理与品牌参数命中时直接复用,原子写入、损坏失效、最近使用淘汰,默认最多 1GB);安全智能直拷(仅 H.264 单连续片段、起点关键帧对齐且无画面滤镜时复制视频流,音频仍完整执行 AAC、边缘淡化、降噪、响度与敏感词静音,任何异常透明回退精确编码);全入口共享(桌面手动、录播监听/webhook、CLI 与 MCP 共用缓存);缓存诊断与清理(设置页双语显示占用,二次确认后只清可重复生成的基础成片,不碰项目、素材、模型和转写缓存)

v0.16.0(2026-08-25)「工程留得住,每一步都能回头」:项目工作区(多工程列表、切换、重命名、关闭、删除与媒体重连,源素材离线/变化不丢工程,旧会话自动迁移);可逆编辑历史(选片、标题/切点、手动加片、逐句稿纠错统一 undo/redo,60 步/4MB 双上限,随项目恢复);专业快捷键(播放/跳播/入出点/候选切换,输入框与弹窗安全让出);本地 A/B 实验中心(一片多版自动按平台建组,稳定内容 ID 关联指标,同平台/72 小时/最低样本门槛,只给谨慎的方向性判断)

v0.15.1(2026-08-24)「任务接得住,发完学得会」:硬件加速出片(VideoToolbox / NVENC / QSV 自动探测,失败透明回退 x264);真实表现中心(导入平台指标,高低表现模式回流选段);公开视频 URL 导入(B站 / YouTube 等地址,官方解析工具自动校验、断点续传);重启接着剪(素材、逐字稿、候选、勾选与手调切点恢复);持久自动化任务中心(录播监听 / webhook 共用队列,历史、取消、重试与中断状态落盘,不存凭据);敏感词音频静音(按逐字时间映射跳剪与多片段,字幕保留原文);发布反馈台账(稳定内容 ID、预填指标 CSV、保守匹配与待回填状态);桌面健康检查(工具、9 类模型、LLM、磁盘/缓存,核心模型准备可取消续传);主题系列整理(重复有效关键词自动分集,变体排除,附 manifest)

v0.15.0(2026-08-20)「向导退役、工作台上岗」:三栏工作台(三步向导退役——左栏素材与录播监听常驻,中央「源画面+竖屏 9:16 实时裁切+时间轴+候选密排表」,右栏候选详情与检测参数,全程一屏不跳页);时间轴上桌(全场响度曲线+弹幕热度曲线+胶片带缩略图,候选段直接画在曲线上,爆点落在哪一眼扫到);候选不怕退(候选与审阅状态进会话仓,切页返回不丢);显式重新检测(改检测参数不再静默重跑整轮,改完自己点「重新检测」);出片方案预设(33 个出片开关收进六组,默认出片/带货全家桶/极简省时三套方案一键切换);设置中心(散落七处的配置——AI 模型/转写引擎/导出与存储/品牌样式/热词词表/录播监听/语言——合并一页);弹幕这票投得更准——抖音直播录制弹幕 .jsonl 兼容(与 B 站录播姬 .xml 双格式自动发现,抖音主播的录播从此也有弹幕证据)、互动事件计权(SC/舰长/礼物/关注/点赞按档加权——花钱和动手的票比弹幕硬)、反刷屏(同一人单窗贡献封顶)、突发加成(相对前一窗跳升计分——爆点是「突然炸」)、信号融合升级(多路共振加成+内容自适应窗口)、弹幕引导采样(表情/语气这类贵模型的算力优先花在观众炸锅处);修复真机预览黑屏(多个 video 同载同一本地流 URL 在 Chromium 撞车)与胶片带缩略图被 CSP 拦截

历史版本(v0.4.3 → v0.14.1)与里程碑一览
  • v0.14.1(2026-08-11)「想得再深、也得出片」:修复「找爆点失败:LLM 未返回内容」(#8)——深度思考型模型把 4000 token 输出预算全烧在思考上、正文为空;检测到「只思考没正文」自动换 16000 大预算重试一次,正文错放 reasoning 字段的兜底取回,仍失败按证据分因报错(烧完预算/安全审查拦截/服务端空响应),每条写明下一步
  • v0.14.0(2026-08-09)「发得出去、活得下来」:变形度评分(本次导出实际做的变形汇总一个分,出片前实时预估、低于 40 黄牌——像素级搬运是 2026 判搬运第一死因);AI 封面双档(按标题生竖版大字封面:Seedream 走量约 ¥0.3/张、Nano Banana Pro 精品约 ¥1/张,复用 Atlas Key);AI 配乐(按品类生成版权安全纯音乐,自动挂进 BGM 混音链);剪映草稿导出(每条切片一个草稿夹,AI 切点全铺进时间轴);说话人标签字幕(彩色「A:」「B:」行首标签);实用密度加分(步骤/清单/数字密集的片标「可收藏」,吃 7 天慢推流);分发台账与留证包(源片区间 CSV 对账+前后 3 分钟源片存档);AIGC 标注助手(按平台给标注文案与入口;超 5 条提示限产);多版反指纹(末版换 flash-forward 开场+模板种子化微扰);保留呼吸口(跳剪可留 0.25 秒停顿);实验性 Linux AppImage(#7)
  • v0.13.0(2026-08-09)「整场看完、敢扔」:质量门三档(零上下文终判建议发/需人审/弃+规则层抓硬伤;判弃折叠可捞回,无人值守只自动导「建议发」档);全场画面扫描(每 30 秒一帧看完整场,画面事件进选段证据;本机免费/云端整场几毛);点题选段(自然语言说要什么不要什么);主播口令打点(「这段剪下来」当最强证据);带货三段式(痛点→演示→价格散点自动拼);文稿选段(点句成片:搜台词/按说话人筛/跨段任选);配置预检(连不上 AI 当场拦下给下一步,#6)
  • v0.12.0(2026-08-05)「挑得准、开场炸」:爆点闪现(正片前先闪 0.3-1 秒最炸瞬间再切回,与高潮前置自动二选一);AI 画面复核(头部候选抽九宫格接触表让视觉模型过目:画面分回流排序、货不对板标警告;本机 Ollama 免费,填 Key 切云端);精准切点(Paraformer 二遍解码词级时间戳 ±50ms,修字幕/跳剪/切点,对不上自动回退);钩子兑付校验(钩子承诺的数字必须真出现在片中);字幕现代化(默认换关键词高亮,逐词弹色升级当前词点亮+阻尼弹入);修复 4 个从未生效的导出开关
  • v0.11.0(2026-08-05)「切完就能发」:平台发布包(导出后按平台整理齐套素材:硬链接视频+按平台画幅重裁封面+按平台上限适配文案,manifest 记录适配项);一片多版(同片 2-3 版差异化包装:换角度标题/悬念句/文案/封面峰,变体标 variantOf,合集与 EDL 只收原版);音效打点与 BGM(whoosh 卡切缝、「叮」卡情绪峰、钩子上屏轻响,每条最多 3 个;BGM 循环铺满+人声闪避+结尾淡出,独立后处理趟零画质损失);动态极简字幕样式
  • v0.10.1(2026-08-05)「换得了模型、扛得住抽风」:AI 模型入口常驻——此前配好一次之后就再也换不了供应商/模型(只有检测报错时才露出那个面板),v0.10.0 新加的 7 家供应商老用户根本点不到;现在工具条上常驻一个写着当前模型名的按钮,随时能换,换完确认会按新模型重跑一次;LLM 吐坏 JSON 自动重试一次(实测主流服务商偶发杂质 token,整轮检测直接失败);信号通道收敛提名数(12 个高能时刻会让模型交白卷,收敛到 8 个)
  • v0.10.0(2026-08-05)「挑得准一点」:切片选段质量重做——支持多片段拼接(把相隔十几分钟的两处摆一起,「前后打脸」这类爆点才成立;剪映的 AI 切片也只做连续区间);直播品类判据照 B站/抖音真实分区重排(补上虚拟主播、电台、萌宠、美食、赛事、手工、一起看等此前整块缺失的品类,一起看类明确禁止切影视画面本身);新增信号驱动候选——跳舞/萌宠/户外这类文字稿是空的、原本一条候选都出不来,现在按画面与声音信号定位高能时刻;笑声不再当爆点本身(它是滞后结果,包袱在它之前)。另有语气与笑声掌声两路新证据、自动运镜剪重录录播姬/blrec webhookLLM 多供应商预设(DeepSeek 官方/百炼/GLM/Kimi/硅基流动/OpenRouter/OpenAI)与模型清单一键拉取(模型 id 会随厂商换代失效,直接问端点要真实清单)
  • v0.9.4(2026-07-31)「中文用户名不再背锅」:修复 Windows 中文用户名下转写必失败(#4)——模型路径自动转 8.3 短路径、音频样本改应用侧读入;跨盘搬模型不再被误拦;模型加载失败给对症提示
  • v0.9.3(2026-07-28)「东西存哪儿、出多大,你说了算」:设置页上线(#3)——模型存放位置可见可搬家、导出画质三档(省空间档小 66%)、默认字幕样式与导出位置收进设置
  • v0.9.2(2026-07-27)「报错说人话、界面不挤乱」:转写失败对症归因(#2);出片选项条自动换行不再撑破界面;导出位置可自选(#3)
  • v0.9.1(2026-07-24)「Windows 首启修复」:修复模型下载 100% 又从头开始的循环(Windows tar 不支持 bzip2,内置纯 JS 解压兜底);解压进度条;临时目录原子落位
  • v0.9.0(2026-07-24)「越用越懂你、装完就能跑」:审阅反馈回流(采用/否决自动进本地偏好档)+ doctor 环境自检 + 模型下载断点续传 + 发布文案角度模板(8 钩子角度×5 CTA)+ 参考爆款入口补全
  • v0.8.0(2026-07-20)「照着爆款切、坏片自己修」:参考视频驱动 + 出片自我修复 + 平台违禁词 lint(120+ 规则)+ Hormozi 大字字幕 + 抽帧接触表(VLM 调用 20→3)
  • v0.7.0(2026-07-16)「切完自检、随叫随剪」:出片自我质检 + Headless CLI 与官方 Agent Skill + 精华合集 + 高潮前置 + 一键双画幅 + 商品讲解模式
  • v0.6.0(2026-07-10)「看得见画面、接得上生态」:六路证据链(+视觉/表情/弹幕)+ 双语字幕 + 本地 MCP Server + 录播监听 + 发布三件套
  • v0.5.0(2026-07-09)「选得准、批量稳」:切片审阅台 + 镜头切点吸附 + 品牌样式模板 + 端侧两级漏斗
  • v0.4.3(2026-07-06)工程底座:转写本地缓存 + clips.json 处理回执
里程碑状态
桌面客户端 · 本地转写三档 · AI 找爆点 · 竖屏+字幕成片 · 舒适智能构图✅ 已完成
说话人分离 · 气泡字幕 · 气口跳剪 · 一键全托管 · 安装包发布✅ 已完成
v0.5 ~ v0.9(审阅台 · MCP · 录播监听 · 质检修复 · 反馈回流 · 设置页)✅ 已发布
v0.10 ~ v0.14(多片段拼接 · 品类判据 · 质量门三档 · 平台发布包 · 一片多版 · 剪映草稿 · 变形度评分 · AI 封面/配乐)✅ 已发布
v0.15(三栏工作台 · 时间轴曲线 · 弹幕互动计权)✅ 已发布
v0.15.1(硬件加速 · URL 导入 · 断点恢复 · 持久队列 · 发布反馈 · 健康检查 · 主题系列)✅ 已发布
v0.16(项目工作区 · 可逆编辑 · 专业快捷键 · 本地 A/B 实验)✅ 已发布
v0.17(有界渲染缓存 · 关键帧安全直拷 · 全入口共享 · 缓存诊断清理)✅ 已发布
v0.18 ~ v0.27(质量评测 · 字幕质量门 · 多模态/屏显文字证据 · 舒适竖屏构图 · 成片质检 · 智能画面校正 · HDR 安全转 SDR · 同轨分析 · 质量封面 · 语音安全切点 · 48k 智能人声增强)✅ 已发布
英文 ASR 升级(Parakeet)· 代码签名 · 无人值守增强🗺️ 规划中

完整更新历史见 Releases · 想投票决定先做哪个?到 Discussions 留言。

常见问题

有什么免费的 AI 切片 / AI 剪辑软件? HotClip 就是——免费开源(AGPL-3.0)、本地运行的 AI 剪辑 / 视频切片工具,把长视频、直播回放一键切成竖屏短视频,无水印、无积分制、不限时长,Windows / macOS / Linux(实验)都有安装包。

直播回放 / 播客怎么一键剪成抖音、B站短视频? 导入文件 → AI 转写并自动识别高光片段(可手动增删调边界)→ 一键导出竖屏 9:16 成片,自带字幕、标题贴片和封面图,直接上传抖音 / 快手 / B站 / 视频号 / 小红书。

AI 剪辑会上传我的视频吗?需要联网吗? 不上传。转写、字幕、切片、导出全程在你自己的电脑上离线完成。只有「AI 找爆点」这一步默认调用云端大模型(只发文字稿,用你自己的 Key),接本机 Ollama 后 100% 离线。

能自动加字幕吗? 能。逐词同步的动态字幕直接烧进画面,关键词高亮/大字弹出/气泡特效等多款样式一档切换,也可导出 SRT 给平台原生上传;开双语字幕还能整句翻译烧成第二行。

能自动剪掉口播里的停顿和口头禅吗?视频如何去气口? 能。「剪气口」自动删掉说话间的静音停顿,「剪口头禅」剪掉嗯/呃与结巴重复——剪了什么逐条写进 clips.json,你始终知道 AI 动了哪里。

弹幕能参与选爆点吗?直播高光怎么找? 能,而且是最硬的证据。HotClip 自动发现录播旁的弹幕文件——B 站录播姬的同名 .xml、抖音直播录制工具的弹幕 .jsonl 都认;弹幕密度、SC / 舰长 / 礼物 / 关注 / 点赞互动直接进爆点判断(单人刷屏有封顶,突然爆发有加成)。没有弹幕文件也不要紧,响度 / 镜头 / 运动 / 表情 / 语气 / 笑声等信号照样兜底。

剪映可以自动切割片段吗?和 HotClip 怎么配合? 剪映的智能切片在会员档,且只能切连续区间。HotClip 免费开源、支持把相隔十几分钟的片段拼成一条,还能把每条切片导出成剪映草稿——AI 粗剪交给 HotClip,打开剪映接着精修,不冲突,是接力。

HotClip 和剪映 / OpusClip / Klap 这类工具的区别? 最大区别是素材不出你的电脑:OpusClip 等 SaaS 必须上传云端、按源视频分钟扣积分(积分月底清零),免费档带水印;剪映的智能切片等核心能力在会员档。HotClip 开源免费、本地处理、无水印、不限时长,AI 切点附理由可审计。详见上方对比表

支持中文视频吗?方言、粤语呢? 支持且是强项。中文识别走专用引擎(SenseVoice/Paraformer/FireRedASR2),准确率显著高于通用模型;方言、粤语、中英混说都覆盖,界面、字幕、prompt 都针对中文内容做了适配。

需要显卡吗?配置要求高吗? 不需要。本地转写用 int8 量化小模型,普通 CPU 就能跑;找爆点的大模型在云端(或你本机的 Ollama)。

可以切别人的直播吗?直播切片如何申请授权? HotClip 面向你自己的内容或已获授权的切片。切别人的直播请先拿到授权(如各平台/公会的主播切片授权计划);未经授权的影视/直播搬运不受支持,也不欢迎。

首次使用,语音模型下载到 100% 又从头开始怎么办? 升级到 v0.9.1 或更新版本即可,老版本的 Windows 解压 bug 已彻底修复;旧版已下载的字节还会自动续传。

开发者

git clone https://github.com/xixihhhh/hotclip.git
cd hotclip
pnpm install
pnpm dev        # 启动桌面应用(开发模式)
pnpm test       # 跑单元测试

技术栈:Electron + React 19 + TypeScript + Tailwind 4 · ffmpeg(打包内置)· sherpa-onnx 本地转写 + 说话人分离 · libass 动态字幕 + 离屏 Chromium 气泡字幕引擎 · LLM 爆点检测(Atlas Cloud / Ollama / 任意 OpenAI 兼容接口,BYO Key)

站在这些开源项目的肩膀上
项目在 HotClip 中的角色
sherpa-onnx本地语音识别运行时(纯 CPU 可跑)
SenseVoice / FunASR五语种快速转写 / Paraformer 中文转写与标点
FireRedASR最高精度档:普通话/方言/中英混说
pyannote-audio + 3D-Speaker说话人分离(本地零上传)
FFmpeg + libass帧精确切割 / 字幕烧录
onnxruntime端侧模型推理

授权与边界

  • 代码:AGPL-3.0-only
  • HotClip 面向你自己的内容已获授权的切片(如主播切片授权计划)。请遵守各平台二创与授权规则——未经授权的影视/直播搬运不受支持,也不欢迎。

社区与同作者项目

  • 🐛 提 Bug / 安装求助 · 💡 功能建议与 Roadmap
  • 🔨 ClipForge — 开源 AI 带货短视频神器:上传一张商品图,AI 提炼卖点、写脚本、配画面配音字幕,一键产出卖货视频。HotClip 把长视频切成爆款,ClipForge 从一张图造出短视频,做电商/带货的朋友可以配着用

Star History Chart

⭐ 觉得有用就点个 Star——Star + Watch 第一时间收到新版本通知,每颗星都是让更多人不用再给积分制付费的一票。

Contributors

xixihhhh

177 commits

xixihhhh/hotclip

免费开源的 AI 剪辑 / 直播切片工具:长视频、直播回放、播客一键切成爆款竖屏短视频,直发抖音/快手/B站/小红书/视频号——AI 找高光金句、弹幕热度进爆点判断、自动加字幕、横屏转竖屏,本地运行无水印不上传 | Free open-source Opus Clip alternative, 100% local: AI clips long videos & livestream VODs into viral 9:16 shorts for TikTok & YouTube Shorts. No credits, no watermark, no uploads. Win/macOS/Linux.

166

stars

177

commits

TypeScript

primary language

Sep 5, 2026

updated

xixihhhh.github.io/hotclip/
ai
ai-clip-generator
auto-subtitles
bilibili
claude-skill
desktop-app
douyin
electron
livestream
local-first
long-video-to-shorts
mcp-server
opus-clip-alternative
podcast-clipper
short-form-video
speech-recognition
tiktok
video-clipping
video-editing
youtube-shorts

README

HotClip 爆款切片 — 本地 AI · 一键切片:长视频、直播回放一键切成爆款竖屏短视频

HotClip 爆款切片 — 免费开源的 AI 直播切片 / 视频剪辑工具

长视频、直播回放一键切成爆款竖屏短视频

简体中文 | English | 官网 | 下载 | FAQ | 反馈

最新版本 下载量 平台 License GitHub stars

AI 自动找爆点(附理由) · 横屏转竖屏 9:16 · 自动加动态字幕 · 去气口剪口头禅

无水印 · 无积分制 · 不限时长 · 素材不上传 · 连注册都不用

本地转写现支持分段保存、停止与续跑;逐句稿提供跨句全文搜索、长稿虚拟列表,以及可试听、确认和撤销的局部时间校准。导出自动改善不同语言的字幕阅读节奏。可选 Qwen3-ASR 本地服务与模型评估命令见 语音与长稿使用指南

导出与取消

导出页会显示素材检查、字幕翻译、文案生成、多版准备、编码和文件整理阶段。准备阶段即可取消,停止清理结束后可以直接重试;重复启动不会覆盖正在运行的任务。进度在文件整理完成前最高显示 99%。关闭烧录字幕、只打开 SRT 导出时,也会保留逐字稿供字幕文件使用。

常规剪切、跳剪、音频成片、合集与动态字幕编码先写目标目录内的独立临时文件,成功关闭编码器后才替换目标。失败或取消的这次编码不会把已有目标文件截断;同一批此前完成的切片保留。普通取消会清理临时目录;系统强制结束进程时可能留下隐藏的 .hotclip-write-* 目录,需在确认没有导出运行后再处理。这是逐次编码的文件保护,不是整批回滚。

为什么选 HotClip

  • 真免费,不是试用:开源 AGPL-3.0,无水印、无积分制、不限时长、无需注册——不存在「免费档阉割」,也没有月底清零的积分
  • 素材不出你的电脑:转写、字幕、剪辑、导出全程本地;未发布素材、客户内容不用交给任何云
  • AI 每一刀都有理由:爆款分 + 开场钩子 + 推荐理由 + 四维分项,切点逐字对齐;字幕时间来源与需复核区间也明确可见——AI 不猜时间戳,也不用虚构置信度替你做决定
  • 自动切点也会先听人声:不到 1MB 的本地语音检测给逐字时间再加一道独立证据;词间空隙仍有人声就不剪,开头结尾在严格上限内保护尾音,证据对不上时完全沿用原切点
  • 有底噪才开,而且能选档:基础档继续用温和固定滤镜;智能档首次下载约 10MB 的 48kHz 本地人声增强模型,在完整剪辑组装后、音效/BGM 混入前只处理讲话原声,不可用时自动回退基础档并在成片回执里说清楚
  • 弹幕直接进爆点判断:自动发现录播旁的弹幕文件(B 站录播姬 / 抖音录制都认),礼物 SC 点赞按互动计权、单人刷屏防伪——观众逐秒投的票,别家工具还没在看的证据
  • 切完就能发:竖屏成片 + 动态字幕 + 封面 + 发布文案 + 平台发布包一次出齐,抖音 / 快手 / B站 / 小红书 / 视频号逐平台整理好
  • 任务断了也接得上:重启自动恢复素材、逐字稿、候选与手调切点;录播监听和 webhook 共用持久任务队列,失败可重试、运行中可取消
  • 长期工程,不是一次性任务:项目工作区集中管理多份工程,源素材离线/变更会明确提示并可重连;标题、切点、勾选和逐句稿都能撤销/重做,重开项目后编辑历史仍在
  • 分析和成片始终看同一画面:多视频轨素材从运动/镜头、时间轴缩略图、表情与视觉复核到最终渲染都绑定同一条选中视频轨;PQ/HLG 的分析预览先安全转成 SDR,证据缓存也按画面与色彩决定隔离
  • 长视频越剪越快:完全相同的基础成片直接复用本地渲染缓存;H.264 单段在关键帧对齐且不改画面时只复制视频流,音频处理照常,条件不满足自动回退精确编码
  • HDR 手机素材不再盲转:PQ/HLG 且色彩信息完整、受支持的 HDR 视频自动安全转成社媒通用 SDR BT.709;路径不完整/不支持就保持既有渲染并明确提示,普通 SDR 不变
  • 画面只在确有必要时校正:可选的智能画面校正只测最终保留帧,明显偏暗、发灰或过饱和才克制修正;正常素材不乱动、黑白素材不强行增艳,不用上传也不新增模型
  • 发出去还会学习:每条成片有稳定内容 ID,导入播放/互动 CSV 后自动对账;一片多版自动形成本地 A/B 实验,只在同平台、同发布窗口、样本充足时给方向判断
  • 睡觉也在出片:录播监听 7×24 盯住录播姬 / OBS 目录,录完自动切;出片前一键健康检查,CLI / MCP 让 Agent 一句话交付

直播切片怎么做?三步出片

一条长视频变成多个爆款短片:AI 智能识别高光时刻,一键生成竖版爆款短视频

  1. 导入:把播客、直播回放、课程、Vlog 丢进来(MP4 / MKV / MOV / FLV / TS,纯音频也行),或直接粘贴 B站 / YouTube 等公开视频地址;首次自动下载并校验官方解析工具,源视频落到本机后进入同一套处理流程
  2. AI 找爆点:本地逐字转写 → AI 通读全文挑出金句、冲突、高能片段,每条附爆款分、开场钩子和推荐理由,切点精确到词;看不顺眼的取消勾选即可
  3. 一键出片:竖屏 9:16 成片直接导出——舒适构图、动态逐字字幕、标题贴片、响度归一,附封面图和发布文案,打开就能发抖音 / 快手 / B站 / 视频号 / 小红书 / TikTok

界面预览

专业工作台:预览 + 信号时间轴 + 候选列表 + 详情栏一屏工作

专业工作台 —— 预览、时间轴、候选表、详情栏一屏工作:弹幕/响度热度曲线直接画在时间轴上,候选段就落在峰上,「为什么选这段」一眼可见;每条候选附爆款分、四维分项与逐字精确切点,弱片自动标「不建议发布」,勾选取舍全在你手。

导入长视频
导入 播客 / 直播回放 / 课程 —— 全程本地处理,素材不上传
选择转写引擎
选转写引擎 —— 素材常驻工作台,三档本地(SenseVoice / Paraformer / FireRedASR2)+ 可选云端,隐私分级明标
逐字转写
逐句稿页签 —— 带时间戳、即点即改,点时间码画面直接跳过去;是找爆点和字幕的地基
一键出片
一键出片 —— 出片方案一键复用,竖屏成片直接发,附封面图与 clips.json 元数据

截图为真实界面(演示素材:一段带货直播回放)。觉得切得准,就点个 ⭐——每颗星都是让更多人不用再给积分制付费的一票,Star + Watch 还能第一时间收到新版本通知。

⬇️ 下载安装

去 Releases 页下载最新版 »

平台文件说明
Windows 安装版HotClip-x.y.z-win-x64.exe双击安装即用
Windows 绿色版HotClip-x.y.z-win-x64.zip免安装,解压即用
macOS(Apple 芯片)HotClip-x.y.z-mac-arm64.dmg拖进「应用程序」
Linux(实验性)HotClip-x.y.z-linux-x64.AppImagechmod +x 后运行;启动报 sandbox 错误加 --no-sandbox

⚠️ 当前版本未做代码签名:Windows SmartScreen 提示时点「更多信息 → 仍要运行」;macOS 首次打开用右键 → 打开(或到「系统设置 → 隐私与安全性」允许)。代码签名已在规划中。

不用 Python、不用 Docker、不用命令行——下载安装包双击即开。

谁在用:直播切片 · 切片带货 · 播客剪辑 · 口播剪辑

  • 主播 / 切片手(直播切片、录播切片):下播后把几小时直播回放自动切成高光短视频;开「录播监听」后 7×24 无人值守,录完自动出片;弹幕热度直接进爆点判断,B 站录播姬 .xml 和抖音直播录制的弹幕 .jsonl 都认
  • 带货 / 矩阵团队(切片带货,已授权):商品讲解模式按转化逻辑选段,一键全托管批量出片,每条附发布文案、封面图与 clips.json 元数据,120+ 违禁词规则发布前点名;一片多版出差异化包装、平台发布包按各平台规格整理齐套素材,多账号多平台拿起来直接发
  • 播客主(播客剪辑、播客视频化):纯音频也能出片——自动合成波形动画画面 + 金句字幕,播客节目直接变竖屏视频
  • 知识区 UP 主 / 口播博主(口播剪辑):自动去气口、剪口头禅、删停顿,长口播变利落短视频,字幕逐字点亮

和 OpusClip、剪映智能切片的区别

市面上的 AI 切片工具,要么按分钟扣积分(一期 2 小时播客烧光整月额度,积分月底还清零),要么必须上传云端(未发布素材/客户内容不敢传),要么切点稀烂、中文支持名不副实;开源侧则几乎全是命令行,小白装不起来。HotClip 把两边的坑同时填上:

HotClipOpusClip / Klap / Vizard 等 SaaS剪映/CapCut 智能切片FunClip / autoclip 等开源
价格免费开源$15-29+/月,按源视频分钟扣积分,积分月底清零核心功能进会员/Pro免费
素材去向全程本地,不上传必须上传云端云端处理为主本地
水印/时长限制免费档有水印、限时长、项目 3 天过期部分模板有限制
账号无需注册需注册,退订删项目需登录
小白可用双击安装即用网页版,易用易用命令行/Docker/自部署
切点质量逐字对齐精确到词,附理由可否决黑盒打分,常被抱怨断章取义黑盒按句切,无爆点排序
竖屏字幕9:16 重构 + 逐字点亮字幕内置有(付费档)自动字幕已进付费多数无竖屏重构

竞品信息核对于 2026-07,具体以各家官网为准。详细英文对比:HotClip vs OpusClip

功能一览

「导入 → AI 找爆点 → 竖屏+逐字字幕成片」三步全流程可下载可用。每组点开看细节——细节里全是真功能,不是形容词。

🎙️ 本地转写:三档引擎,逐字时间戳

已有原文字幕时,在转写页点击 导入字幕,选择与当前素材对齐的 UTF-8 SRT / WebVTT,即可进入逐句稿、纠错和文字选段;需要 AI 分析时再点击检测。导入本身不运行 ASR,也不覆盖已有转写缓存。保留字幕原句时间,句内字词时间明确标记为估算,可通过「需复核」筛选检查;手动拼接严格遵守选段边界。

CLI 的 transcribehighlightsclip 均支持 --subtitles "/path/original.srt",三个 MCP 工具均支持 subtitlePath。例如 pnpm cli transcribe "/path/video.mp4" --subtitles "/path/original.vtt" --json 可输出带时间来源的结构化逐句稿。支持单轨原文字幕,最大 5 MB、20,000 段、100,000 字词;重叠、乱序、超出素材时长或带流媒体时间映射的字幕会提示修正后再导入,不会静默丢句。

快速 SenseVoice(五语种,170MB)/ 均衡 Paraformer(中文更准)/ 最准 FireRedASR2(普通话/方言/中英混说)——全部本地运行、普通 CPU 就能跑,首次自动下载(国内镜像优先、断点续传);另有云端档 ElevenLabs(自带 Key,只上传音轨)。

展开细节:转写缓存 · 逐句稿即点即改 · 热词词表 · 说话人分离
  • 转写结果本地缓存:同一个文件下次再开、换设置多切几条,跳过重转写秒进挑爆点;文件改动或换引擎自动失效
  • 逐句稿即点即改(转写纠错):每句 hover 出铅笔当场改,字幕、双语翻译、发布文案全用修正后文本;重建的逐词时间会明确标「估时」,可一键只看需复核句
  • 热词词表(专有名词一次纠错,期期自动修正):人名/品牌/术语改一处,一键应用到全片同错句并入词表;之后每次转写自动整词替换,词表更新后同素材直接用缓存重放、不重跑识别
  • 多人对谈「谁在说话」:一键说话人分离(本地 pyannote + 3D-Speaker,零上传),逐句标注谁在说;AI 按说话人挑段不断章取义,气泡字幕按人上色

🔥 AI 找爆点:九路证据链,每一刀都有理由

LLM 只负责«挑哪段»并引用原文,时间戳由逐字转写反向对齐——不让 AI 猜时间。每条候选附爆款分、开场钩子、推荐理由与四维分项,弱片自动标「不建议发布」。

展开细节:复评质量门 · 弹幕/表情/视觉信号 · 画面复核 · 参考爆款 · 省钱漏斗 · 商品模式
  • AI 复评质量门:严格评审员二次盲评,钩子/结构/价值/热点四维分项打分,每维一句话理由,另给一条可烧上片头的悬念句
  • 爆款分=排名不是玄学:四维加权后按候选间相对排名归一(推荐档 76-99),同批次可直接比大小,不受批间漂移影响
  • 画面声音证据:响度峰值、镜头切换密度与轻量运动峰值本地采集注入判断;工作台时间轴直接显示运动曲线,不再纯文本盲选
  • 弹幕热度信号(B 站 / 抖音双格式):自动发现录播旁的弹幕文件——录播姬同名 .xml、抖音直播录制的弹幕 .jsonl 都认;滑窗密度+高能词加权圈出观众实时高能段,SC/舰长/礼物/关注/点赞按互动档另计权(花钱和动手的票比弹幕硬);同一人刷屏有贡献封顶(一个人刷一百条不算全场沸腾),突然爆发另有加成——观众逐秒投的票,证据力最强
  • 信号共振与算力聚焦:多路信号同秒共振才可信——只有音量高可能是 BGM,只有弹幕高可能是刷屏,音量+弹幕+笑声一起亮才是真爆点;运动峰与均匀全场覆盖共同引导抽帧,避免前半段热闹画面挤掉后半段安静但重要的场景
  • 本地多模态证据索引:响度/镜头/运动、TransNetV2 边界与可选视觉扫描结果按「源文件指纹 + 能力版本 + 模型」原子落盘;桌面、CLI、MCP、录播监听与 webhook 复用同一份结果。默认最多 64MB、最近使用淘汰,损坏或配置变化自动重算,视觉 API Key 从不写入索引
  • 表情峰值信号:YuNet + FER+(几 MB 的 MIT 协议模型)找大笑/惊讶/激动峰值,零配置让 AI「看见」情绪爆点
  • 视觉爆点信号(可选):新用户默认预填本机 Ollama qwen3.5:4b,一个多模态模型同时处理文字与九宫格接触表,研判画面高能时刻,专治逐字稿里看不见的画面梗;端点不可用自动跳过,不会挡住纯文字找爆点
  • AI 画面复核(可选):检测后对头部候选再抽九宫格让视觉模型过目——画面炸裂加分、信号候选画面死气降分、画面与标题货不对板标警告,看点写进推荐理由;本机 Ollama 免费,视觉设置填 API Key 即切云端模型
  • 参考视频驱动:丢一条想对标的爆款切片,本地实测节奏生成风格画像,选段向对标靠拢(CLI --reference)
  • 审阅反馈回流:你采用/否决的候选自动落进本地偏好档,下次「同类优先/同类少选」,越用越懂你;偏好数据不出本机
  • 真实数据反哺选段:把平台导出的 CSV/JSON 播放与互动数据交给 pnpm cli feedback,HotClip 在本机归纳高/低表现内容的题材、钩子与时长共性;桌面端/CLI/MCP/录播监听下一轮找爆点都会参考真实观众结果,不照抄旧标题、不上传账号数据
  • 端侧两级漏斗(省钱):本机小模型先初筛,云端只精读入围段——长视频云端 token 花费降一个量级,切点精度零损失
  • 镜头切点吸附:TransNetV2 本地检测真实镜头边界,切点自动吸附(词边界守卫绝不切掉说话)
  • 商品讲解模式(带货直播切片):填商品词,按「试用实测 > 卖点 > 价格机制」转化逻辑选段;纯憋单拉互动段(平台判违规)明确排除
  • 切片时长档:短·10-30s / 标准·8-40s / 长·40-90s 一键切换重选段,目标时长作为硬约束进提示词

📝 字幕与文案:自动加字幕、发布文案一步到位

动态字幕多款样式一档切换——关键词高亮、大字弹出、气泡特效、动态极简——词级时间戳驱动、语义断行不拦腰截断,SRT 可导出、双语可选;AI 起的爆款标题自动烧进顶部贴片,发布文案带标签生成。

展开细节:气泡特效字幕 · 开场钩子 · 双语 · Hormozi 大字 · 违禁词 lint · AIGC 标识
  • 语义断行(免 Key):顺着标点在真实子句处换行,长句无标点时回看结构助词断行——等价于头部项目用 LLM 插 [br],但零额外调用
  • 气泡特效字幕(Web 渲染引擎):内置 Chromium 离屏逐帧渲染 CSS 字幕层——自适应圆角气泡底、关键词渐变金字、弹性入场,libass 做不出的效果一档切换
  • 开场钩子(黄金3秒):AI 写的悬念句自动大字烧在开头 2 秒上三分之一,淡入淡出避开主体;没写出悬念句自动不加
  • Hormozi 大字爆点字幕:带货营销风,特大加粗、硬阴影、逐词点亮
  • 说话人标签字幕:多人对谈时换人行首自动加彩色「A:」「B:」标签(与气泡字幕按人上色同一套色板),观众一眼分清谁在说
  • 双语字幕(出海一步到位):整句语境翻译烧成副轨,中文源自动译英;跳剪压缩时译文行同步重映射
  • SRT 字幕文件导出:时间轴已对齐跳剪/剪口头禅后的成片,断行与烧录字幕一致
  • 发布文案生成:每条切片生成钩子风标题 + 3-6 个垂类标签 + 简介,落 .post.txt 与 clips.json;8 种钩子角度 × 5 类 CTA 可选
  • 平台违禁词 lint:120+ 本地规则扫标题/文案/字幕,绝对化用语/医疗宣称/导流话术发布前点名,零上传
  • AIGC 标识(合规内建):按《人工智能生成合成内容标识办法》一键打标——显式画面标识 + 隐式元数据标识

🎬 成片质量:像人剪的,不是机切的

舒适优先智能取景、气口跳剪、剪口头禅、响度归一 -14 LUFS、帧精确切割——制作链一步到位,每条切片出片后还有自我质检。

展开细节:横屏转竖屏 · 去气口 · 降噪 · 音效 · BGM · 质检自修复 · 智能封面 · 高潮前置 · 爆点闪现 · 精准切点
  • 舒适优先智能取景(横屏转竖屏 9:16):逐镜头汇总所有可见人脸;单人移动或多人同框只要能安全装进竖屏就锁住机位,避免追脸晃动。确实超出画幅才平滑跟随,短暂漏检先保持、持续丢失自动回正,无人脸回退居中裁剪
  • 构图回执:clips.json 记录每条成片锁定/多人锁定/跟随/丢失回正/居中兜底的镜头数;镜头锁定会保持到下一次切镜,跳剪也不会让裁窗穿过被删区间
  • HDR 安全转 SDR(自动):输入需同时具备 PQ(ST 2084)或 HLG 传递、BT.2020 原色、BT.2020 非恒定亮度矩阵与 TV/PC 范围,才会先在线性光域克制映射高光,再输出电视范围 SDR BT.709;有 MaxCLL / mastering 峰值时用于约束高光,缺失则交给 FFmpeg 安全估计。连续剪、跳剪、多片段、高潮前置、Web 字幕与质检修复走同一决定。检测到 HDR 但色彩路径不完整/不支持时不猜测、不套用 SDR 域智能校正,完成结果会提示未转换;若色彩信息检查本身失败,同样停用 SDR 域智能校正并明确提示检查失败;普通 SDR 沿用原路径。不新增模型、下载或上传,源色彩信息与决定写入 clips.json
  • 智能画面校正(可选,默认关):复用本地 Tier-0 分析,按每条最终保留片段测量亮度、反差与饱和度;只对证据充分且明显偏暗/发灰/过饱和的画面做有硬上限的轻校正,正常素材保持原样、接近黑白的素材不强行增艳。跳剪、多片段与高潮前置分别按真实保留窗口计算,具体测量和调整进入 clips.json
  • 去录屏UI:手机直播录屏的状态栏/固定UI/黑边,时域方差自动检测裁除
  • 语音感知气口跳剪(自动去气口):剪掉停顿静音并拼接,字幕时间轴同步重映射;「无词 + 声学静默 + 本地语音检测无人声」三重判定,ASR 漏词、轻声尾音、笑声掌声都不会被当空白误删;可选保留 0.25 秒呼吸口——节奏紧凑但不窒息。手调/拼接外边界不改,模型或证据异常精确回退旧逻辑
  • 剪口头禅:嗯/呃、结巴重复自动剪除(词表刻意保守),剪了什么逐条写进 clips.json
  • 响度标准化:每条按 EBU R128 归一到 -14 LUFS 社媒标准,整批音量一致;跳剪后按拼接后音轨计算
  • 双档人声降噪(显式开启):基础档沿用双高通 + 温和谱减;智能 48k 档首次按需下载约 10MB、经 SHA-256 校验的 DPDFNet2 本地模型,按声道分块增强最长 180 秒成片,视频流直拷。模型、下载或推理异常自动回退基础档;完成页与 clips.json 区分“智能生效 / 已回退 / 未应用”,字幕和逐字稿不改
  • 音效打点:whoosh 卡多段拼接/高潮前置的硬切缝、「叮」卡全片情绪最高点、开场钩子上屏轻响——规则打点每条最多 3 个宁缺毋滥;音效本地合成零素材零版权,想换真实音效包替换同名 wav 即可
  • 背景音乐(BGM 闪避):选个本地音频自动循环铺满全片,音量压在人声之下、说话时自动闪避、结尾淡出;混音是独立后处理趟,视频流直拷零画质损失
  • 出片自我质检 + 自我修复:黑屏/长静音/冻结帧/主体出框/响度/时长/切点半词复核写进 clips.json;冻结和构图问题只提醒回放核对,可安全自愈的告警才当场修复,修完重检变好才采纳
  • 高潮前置(cold-open):最炸的钩子句自动剪到开头再接正片——完播率手法,商业工具锁在付费档;定位失败自动跳过,宁可不做不可做错
  • 爆点闪现(flash-forward):正片开始前先闪 0.3-1 秒全片最炸瞬间再切回——悬念开场手法(全网仅 0.04% 切片有 visual hook);与高潮前置自动二选一,定位失败自动跳过
  • 精准切点(Paraformer 二遍对齐):导出前对选中片段二遍解码,一体化词级时间戳修正字幕、跳剪与切点;对齐词/内插词、匹配覆盖率与不确定区间写进回执,低匹配或异常仍自动回退
  • 字幕时间质量门:按最终跳剪/拼接后的真实时间轴检查重叠、无效时间、阅读速度、闪现短句、超宽词与估时区间;结果随每条成片写入 clips.json,问题可定位而不是只报一个“失败”
  • 质量排序智能封面:响度峰先提名有内容的时刻,再在最终成片上本地比较清晰度、信息量、曝光、明暗跨度与转场稳定性;黑白场/模糊过渡帧先淘汰,一片多版按排名取不同封面,探测失败原样回退旧响度峰
  • 帧精确切割:快速定位+重编码,爆点第一秒不糊不偏;数小时 FLV/TS 直接进
  • 硬件加速出片:自动探测随包 ffmpeg 支持的 VideoToolbox / NVENC / QSV,H.264 重编码优先走 GPU;设备或驱动临时不可用会透明回退 x264,不拿速度换可靠性
  • 导出可取消 + 实时进度:ffmpeg 进度流式回报,随时一键取消,已完成切片保留

🧰 审阅与工作流:AI 粗剪,人终剪

导出前应用内看片微调:切片审阅台(波形时间轴拖手柄逐词调切点)、字幕安全区预览(九平台真实遮挡遮罩)、出片偏好记忆、品牌样式模板。

展开细节:项目工作区 · 可逆编辑 · 断点恢复 · 审阅台 · 安全区 · 发布包 · 主题系列 · 一片多版 · 品牌模板 · 双画幅 · 合集 · EDL · 设置页
  • 项目工作区:多份剪辑工程集中管理,切换/重命名/关闭/删除互不串档;源素材缺失或被改动时保留工程并明确标记,重新选择文件即可安全重连,删除工程绝不删除素材
  • 可逆编辑 + 专业快捷键:选片、标题/切点、多片段调整、手动加片和逐句稿纠错都支持撤销/重做,历史随项目保存且有容量保护;空格/K 播放、J/L 前后 5 秒、I/O 设入出点、[/] 切换候选,输入框和弹窗中自动让出
  • 重启接着剪:当前素材、逐字稿、候选、勾选结果与手调切点自动保存;重开应用校验源文件后恢复到最后稳定状态,检测中/导出中等临时状态不会被错误复活
  • 切片审阅台:应用内直接播放候选,波形时间轴拖两端手柄逐词微调(自动吸附字词边界),一键还原 AI 切点;手调过的切点导出时机器不再改人的决定
  • 字幕安全区预览:一键叠加平台 UI 遮挡遮罩(抖音/快手/B站竖屏/视频号/小红书/TikTok/Reels/Shorts + 通用并集九档,按实测数据画)
  • 平台发布包(切完就能发):导出后按平台整理齐套素材到「发布包/」——每平台一个文件夹:视频(硬链接不占双份磁盘)+ 按平台画幅重裁的封面(小红书 3:4、B站 16:10、视频号 6:7)+ 按平台上限适配的文案(小红书标题硬截 20 字、话题数各按平台建议),manifest 记录适配了什么;打开文件夹逐平台上传即可
  • 主题系列自动整理:同场至少两条原版成片共享关键词时,按源片时间整理到「系列/主题/」并编号,附机器可读 manifest;变体不会被误当成剧集,视频仍优先硬链接不重复占空间
  • 一片多版(多账号真差异):同一切片一次出 2-3 版差异化包装——不同钩子角度的贴片标题、开场悬念句、发布文案,封面自动抓下一个响度峰;多账号分发靠增量价值,不做抽帧/镜像那类已被平台判搬运的像素级去重
  • 品牌样式模板:主高亮色/字幕字号位置/logo 水印配一次存成预设,每条切片自动带上;用了什么写进回执
  • 一键双画幅:同批切片竖屏之外再出一版横屏(自动去标题贴片、字幕换底部布局),竖版发抖音、横版发B站一次搞定
  • 精华合集一键成片:整批切片流复制拼接成合集(秒级零损),附章节时间戳,B站/YouTube 周更形态现成
  • 时间线 EDL 导出:timeline.edl(CMX3600)含跳剪的每一刀,导入 DaVinci / Premiere 重链源片继续精修
  • Audiogram 音频成片:纯音频源自动合成深色底+品牌色波形动画画面,播客也有「画面」
  • 出片偏好记忆 + 标题即点即改:开关组合自动记住;候选标题点铅笔就改,文件名/贴片/文案全跟着走
  • 设置页:模型存放位置可见可搬家(跨盘走「复制→校验→才删原件」)、导出画质三档(省空间档体积小 66%)、默认字幕样式与导出位置
  • 新版本提示:启动静默检查,有新版页头亮小徽标;断网全静默

🛡️ 发布合规:发得出去、活得下来

2026 年的分发环境:像素级搬运判定、AIGC 强制标识、收藏率权重——切得好只是一半,这组功能管另一半:发出去不被判搬运、被质疑时拿得出证据。

展开细节:变形度评分 · AI 封面 · AI 配乐 · 剪映草稿 · 台账留证 · AIGC 标注 · 反指纹多版
  • 变形度评分:本次导出实际做的变形(取景/跳剪/字幕/贴片/音效…)汇总成一个分,出片前实时预估,低于 40 黄牌提醒——像素级搬运是 2026 判搬运第一死因
  • AI 封面双档(可选):按切片标题生成竖版大字封面,走量档约 ¥0.3/张、精品档约 ¥1/张(复用 Atlas Key);与抓帧封面并存,想用哪张用哪张
  • AI 配乐(可选):按直播品类生成版权安全的纯音乐 BGM,自动挂进人声闪避混音链——商用曲库的版权风险归零
  • 剪映草稿导出:每条切片落一个剪映草稿文件夹,AI 的每一刀都铺在时间轴上——粗剪交给 HotClip,精修进剪映接力,不从零开始
  • 发布反馈台账:每条成片登记稳定内容 ID 与发布状态,一键生成待回填指标 CSV;导入真实播放/互动后按 ID 或唯一标题保守对账,未匹配/歧义行明确列出,表现规律回流下一轮选段
  • 本地 A/B 实验中心:一片多版自动按原候选、导出批次和平台建对照组;只比较同平台、72 小时内发布、每版至少 500 播放且数据齐全的版本,区分等待/证据不足/差异不明显/方向性领先,明确不作单变量因果承诺
  • 分发留证包:每条切片对应的源片区间落 CSV 台账,可选保存前后 3 分钟源片切段——授权切片被质疑搬运时,证据链拿得出手
  • 敏感词音频静音(可选):按逐字稿时间把自定义词表对应的音频静音,跳剪与多片段拼接后仍精确映射;字幕和逐字稿保留原文,便于审阅与追溯
  • AIGC 标注助手:按平台给标注文案与操作入口指引,一键复制;单场超 5 条提示限产(2026 算法偏好质量不偏好数量)
  • 多版反指纹:一片多版的末版自动换爆点闪现开场 + 模板种子化微扰(字号/基线/边距各有细微差异)——多账号分发不撞视觉指纹,且全部是真差异不是像素伪原创

🤖 批量与生态:CLI / MCP / Agent Skill

一键全托管(导入后点一个按钮全自动出片)+ 录播监听 7×24 无人值守 + Headless CLI + 本地 MCP Server——唯一本地不上传的切片 Agent 工具链

展开细节:持久任务队列 · 录播监听 · 健康检查 · CLI · MCP · Claude Code 技能
  • 持久任务中心:录播监听与 webhook 共用单并发队列,任务阶段、历史与重试次数落盘;可取消、可手动重试,应用重启后运行中任务标记为「已中断」而不是偷偷续跑,凭据从不写进历史

  • 长视频性能层:相同源文件、切点与基础效果重复导出时直接复用本地基础成片;H.264 连续片段仅在起点确认对齐关键帧且没有画面滤镜时直拷视频,音频仍执行淡化、降噪、响度和敏感词静音,失败透明回退精确编码。缓存按最近使用自动限制在 1GB,设置页可查看并单独清理

  • 录播监听(7×24 无人值守):盯住录播姬/OBS 输出目录,新录播落稳自动转写→找爆点→出片;「连续两轮大小不变」才算录完绝不切半截

  • 桌面健康检查:设置页一键检查 FFmpeg/FFprobe、解析工具、11 类模型、LLM 连通/鉴权/路由、磁盘、转写缓存、渲染缓存与多模态证据索引;缺少核心模型时显式准备,支持取消与断点续传;1GB 渲染缓存与 64MB 证据索引可分别安全清理

  • Headless CLI(与桌面端产物完全一致):

    pnpm cli transcribe 直播回放.mp4                 # 端侧逐字转写(带缓存)
    pnpm cli highlights 直播回放.mp4 --json          # AI 爆点候选,先审后剪
    pnpm cli clip 直播回放.mp4 --max-clips 10 --smart-denoise  # 全托管 + 48k 智能人声增强
    pnpm cli feedback bilibili.csv                   # 导入真实播放/互动表现
    pnpm cli feedback-report                         # 查看已学到的高/低表现模式
    pnpm cli doctor --download                       # 环境自检 + 预下载模型
    
  • 本地 MCP Server:Claude Code / Claude Desktop 注册后,一句「把这个 4 小时录播切 10 条爆点」就是完整交付;三个工具 clip_video / detect_highlights / transcribe_video

    {
      "mcpServers": {
        "hotclip": {
          "command": "npx",
          "args": ["-y", "tsx", "src/mcp/server.ts"],
          "cwd": "/path/to/hotclip",
          "env": {
            "HOTCLIP_LLM_BASE_URL": "http://localhost:11434/v1",
            "HOTCLIP_LLM_MODEL": "qwen3:8b"
          }
        }
      }
    }
    
  • 官方 Agent Skill:把这段话直接粘给 Claude Code / Codex,Agent 会自己完成安装:

    请安装 HotClip 作为我的本地切片技能:git clone https://github.com/xixihhhh/hotclip.git && cd hotclip && pnpm install,然后把 skills/hotclip/ 复制到我的 Agent skills 目录(Claude Code 为 ~/.claude/skills/hotclip/),并按 skills/hotclip/SKILL.md 里的说明配置 LLM 环境变量。装好后用一段测试视频跑 pnpm cli highlights 验证。

  • clips.json 处理回执:每条片 AI 动了什么(字幕样式/取景模式/跳剪比例/语音证据覆盖与保护剪口/对齐覆盖/字幕质检/封面选择模式与得分/剪了几个口头禅)一目了然,可审计,矩阵管线直接取用

  • 质量黄金集:pnpm quality:eval [fixture.json] 本地输出 CER/WER、词边界中位/P95 误差与爆点 recall@3/@5;以后换模型、调阈值先跑同一套样本,质量变化有数可查

  • 本地视觉模型对比入口:HOTCLIP_VISION_MODELS=qwen3-vl:4b,qwen3.5:4b pnpm quality:eval:vision 用同一批演示片、同一套九宫格与结构化解析比较成功率、耗时和画面证据;模型由你的 Ollama 管理,HotClip 不捆绑数 GB 权重

  • 模型自带干粮也行:默认本地免费模型;更强的爆点判断可一键接 Atlas Cloud、fal.ai 或任意 OpenAI 兼容接口,或本机 Ollama 完全离线

最近更新

v0.28.0 (2026-09-05):字幕导入与长稿编辑(SRT / WebVTT、跨句搜索、局部校准预览与撤销);本地语音续跑(分段保存、停止恢复、可选 Qwen3-ASR);字幕阅读节奏优化更可靠的导出(准备阶段取消、安全写入、直接重试、仅导出 SRT)。完整发布说明

v0.27.0(2026-08-31)「先把人声听清,再谈包装」:48kHz 智能人声增强(显式智能档首次按需下载约 10MB、SHA-256 校验的 DPDFNet2,按声道分块处理完整剪辑,视频流直拷);发布链路顺序正确(在高潮前置/多片段组装之后、音效与 BGM 混入之前处理原声,响度在增强后统一,避免把包装层当噪声);可用性优先(模型、下载、解码或推理异常自动回退原有基础降噪,关闭/基础档行为不变,完成页与 clips.json 如实记录智能生效/回退/跳过);端侧多模态预设升级(新用户本地视觉端点默认 qwen3.5:4b,文字与接触表共用同一模型,并新增可复现的本地 VLM 对比命令);桌面、CLI 与 MCP 共用同一档位语义,真实官方模型 48k 冒烟与 FFmpeg 集成回归通过

v0.26.0(2026-08-31)「切得更紧,但一个尾音也不赌」:本地语音活动证据(复用现有 sherpa-onnx 原生运行时,新增经 SHA-256 校验的 629KB 模型,不装 Python、不上传音频);安全外边界(只在语音与逐字时间相互印证时,于 0.6 秒硬上限内保护开头/结尾尾音并约束后续镜头吸附,手调与拼接外边界不动);三重跳剪门(无词、低峰值且 VAD 无人声才删,ASR 漏掉的轻声/短词会保留);多音轨一致(语音与响度证据显式读取最终渲染选中的同一条音轨);可审计回退(clips.json 记录覆盖率、边界位移与保护剪口,长区间/低覆盖/模型或解码失败完全回退既有行为);真实带前后静音语音样片与多音轨 FFmpeg 回归通过

v0.25.0(2026-08-30)「分析看对画面,封面挑对一帧」:全分析链路同轨(运动/镜头/画面统计、TransNetV2、表情抽帧、VLM 接触表、候选复核、时间轴胶片带、去录屏 UI 与人脸取景全部绑定最终渲染选中的全局视频轨);HDR 分析预览(仅对元数据完整且可执行的 PQ/HLG 路径先做同款 SDR 预览再缩放/取样,普通 SDR 与不完整 HDR 保持既有 fail-open 行为);缓存不串画面(Tier-0、镜头与视觉证据按选中轨和色彩计划版本隔离);质量排序封面(响度峰与均匀时刻共同提名,在最终 QA 后成片上用捆绑 FFmpeg 淘汰黑白场、低信息/模糊与不稳定过渡帧,变体取下一名,失败精确回退旧时刻);无新增模型、依赖、下载、上传或云端费用,真实双视频轨 PQ 样片与四场景封面黄金集进入回归

v0.24.0(2026-08-30)「HDR 色彩不靠猜,能安全转才转」:严格元数据门(读取像素格式、位深、原色/传递/矩阵/范围与可用的 MaxCLL / mastering 峰值;PQ/HLG 还需完整且经捆绑运行时验证的 BT.2020 非恒定亮度色彩路径才转换,不凭 10-bit 或 BT.2020 单项猜测);受控转成 SDR BT.709(显式输入色彩→线性化→保色优先 Mobius tone map→10 到 8-bit 误差扩散抖动,最后写入 TV-range BT.709 标签);异常也不藏(HDR 路径不完整/不支持时提示未转换,色彩检查失败时单独提示检查失败,两者都禁用不适用的 SDR 域智能校正;桌面/CLI/MCP 与 clips.json 状态一致);全渲染路径一致(连续剪、跳剪、多片段、高潮前置、字幕叠加与质检修复共享决定);单视频轨 SDR 的像素处理与安全直拷判定不变,多轨则显式选中同一画面并按所选轨隔离缓存,全程本地且无新模型/下载

v0.23.0(2026-08-30)「画面里写着什么,也应该成为证据」:屏显文字证据(复用已经开启的全场视觉扫描与候选复核,不装新 OCR、不增加模型调用;只保留可逐字确认的产品名、价格、比分、标题与 PPT 要点,不确定就留空);静态内容不漏(为低画面能量但有清晰文字的价格牌/PPT 保留证据席位,让带货、课程、评测的关键事实进入选段提示);结构化候选复核(实拍场景、画面分、标题匹配与屏显文字进入候选数据、CLI/MCP 输出和 clips.json,审阅台中英双语直接可见);封面更对题(AI 封面优先使用视觉复核观察到的真实场景,不再只靠转写钩子猜画面);沿用原有可选视觉开关,未开启时零额外成本、失败自动回退

v0.22.0(2026-08-30)「画面该救才救,正常素材一帧不乱动」:智能画面校正(桌面出片方案、CLI --auto-enhance 与 MCP 统一显式开启,默认关闭);片段级实测(复用已有 4fps Tier-0 解码采集亮度低位/均值/高位与饱和度,按跳剪或多片段最终保留的源时间单独统计,不新增模型和完整解码);克制有上限(只在证据充分且明显偏暗、发灰、过曝或过饱和时轻调亮度/反差/饱和度/gamma,正常素材不加滤镜,黑白素材不强行增艳);全链路一致(连续剪、跳剪和高潮前置使用对应窗口的校正,滤镜置于裁切缩放之后、字幕水印之前);可审计可复用(clips.json 记录测量、原因与精确调整,渲染缓存按派生方案区分,超长录播证据均匀有界)

v0.21.0(2026-08-30)「成片不只导出来,还要证明画面没坏」:冻结帧质检(同一次 FFmpeg 扫描识别持续 3 秒以上的异常静止画面,片尾冻结也能闭合记录);主体覆盖率(复用已有 YuNet 人脸采样,按最终竖屏裁窗统计未完整保留与严重出框帧,不新增模型扫描);镜头锁定修正(锁定构图真正保持到下一镜,不再缓慢漂向后续镜头);跳剪轨迹对齐(裁窗在删掉的源片区间前后瞬时衔接,不会隔着被删内容错误插值);冻结与构图属于需人工回放的语义告警,不会冒险自动重剪

v0.20.0(2026-08-30)「主体留在画里,镜头别乱跑」:舒适优先竖屏构图(逐镜头汇总所有可见人脸的安全包络,单人移动/多人对谈能装下就锁住机位,只有确实需要时才平滑跟随);居中吸附(原片已接近中心时尊重摄影构图,不制造无意义偏移);丢失回正(短暂漏检保持当前主体,持续 1.25 秒后平滑回到中心,不再长期守着空画面;无可靠人脸的新镜头立即居中);全链路回执(clips.json 记录镜头总数、锁定、多人锁定、跟随、回正与居中兜底数量,拼接片逐段聚合);不新增模型、不增加安装包体积,检测不足仍安全回退居中裁剪

v0.19.0(2026-08-28)「证据只算一次,下一刀更快更准」:本地多模态证据索引(源文件指纹、能力版本与模型共同定址,原子写入、损坏失效、最近使用淘汰,默认最多 64MB);九路证据链(新增无需模型的轻量运动峰值,与文本/响度/镜头/表情/视觉/弹幕/语气/笑声掌声共振);看得见的运动依据(工作台时间轴新增运动曲线,代表帧同时保留全场均匀覆盖);昂贵分析跨入口复用(Tier-0 信号、TransNetV2 镜头边界与可选 VLM 扫描在桌面、CLI、MCP、录播监听/webhook 间共享,模型或算法变化自动重算,API Key 不落盘);独立诊断与清理(证据索引与渲染/转写缓存互不误删,清理后二次生成即可恢复)

v0.18.0(2026-08-28)「质量看得见,升级有尺子」:逐词时间来源(原生/二遍对齐/内插/手工改稿/缺失估时,旧工程兼容);聚焦复核(逐句稿估时徽标与一键筛选,候选详情显示字幕时间回执);局部对齐报告(匹配覆盖、对齐/内插词数与不确定区间进入 clips.json);字幕质量门(无效时间、重叠、阅读速度、闪现、超宽词与估时区间按最终成片时间轴检查);可重复质量评测(本地黄金集命令输出 CER/WER、词边界误差和爆点 recall@K,不下载新模型);新增独立 dev:web 浏览器预览,清掉 Electron 运行包也能做 UI 回归

v0.17.0(2026-08-25)「长视频越剪越快」:有界基础渲染缓存(同源文件、切点、字幕/裁切/音频处理与品牌参数命中时直接复用,原子写入、损坏失效、最近使用淘汰,默认最多 1GB);安全智能直拷(仅 H.264 单连续片段、起点关键帧对齐且无画面滤镜时复制视频流,音频仍完整执行 AAC、边缘淡化、降噪、响度与敏感词静音,任何异常透明回退精确编码);全入口共享(桌面手动、录播监听/webhook、CLI 与 MCP 共用缓存);缓存诊断与清理(设置页双语显示占用,二次确认后只清可重复生成的基础成片,不碰项目、素材、模型和转写缓存)

v0.16.0(2026-08-25)「工程留得住,每一步都能回头」:项目工作区(多工程列表、切换、重命名、关闭、删除与媒体重连,源素材离线/变化不丢工程,旧会话自动迁移);可逆编辑历史(选片、标题/切点、手动加片、逐句稿纠错统一 undo/redo,60 步/4MB 双上限,随项目恢复);专业快捷键(播放/跳播/入出点/候选切换,输入框与弹窗安全让出);本地 A/B 实验中心(一片多版自动按平台建组,稳定内容 ID 关联指标,同平台/72 小时/最低样本门槛,只给谨慎的方向性判断)

v0.15.1(2026-08-24)「任务接得住,发完学得会」:硬件加速出片(VideoToolbox / NVENC / QSV 自动探测,失败透明回退 x264);真实表现中心(导入平台指标,高低表现模式回流选段);公开视频 URL 导入(B站 / YouTube 等地址,官方解析工具自动校验、断点续传);重启接着剪(素材、逐字稿、候选、勾选与手调切点恢复);持久自动化任务中心(录播监听 / webhook 共用队列,历史、取消、重试与中断状态落盘,不存凭据);敏感词音频静音(按逐字时间映射跳剪与多片段,字幕保留原文);发布反馈台账(稳定内容 ID、预填指标 CSV、保守匹配与待回填状态);桌面健康检查(工具、9 类模型、LLM、磁盘/缓存,核心模型准备可取消续传);主题系列整理(重复有效关键词自动分集,变体排除,附 manifest)

v0.15.0(2026-08-20)「向导退役、工作台上岗」:三栏工作台(三步向导退役——左栏素材与录播监听常驻,中央「源画面+竖屏 9:16 实时裁切+时间轴+候选密排表」,右栏候选详情与检测参数,全程一屏不跳页);时间轴上桌(全场响度曲线+弹幕热度曲线+胶片带缩略图,候选段直接画在曲线上,爆点落在哪一眼扫到);候选不怕退(候选与审阅状态进会话仓,切页返回不丢);显式重新检测(改检测参数不再静默重跑整轮,改完自己点「重新检测」);出片方案预设(33 个出片开关收进六组,默认出片/带货全家桶/极简省时三套方案一键切换);设置中心(散落七处的配置——AI 模型/转写引擎/导出与存储/品牌样式/热词词表/录播监听/语言——合并一页);弹幕这票投得更准——抖音直播录制弹幕 .jsonl 兼容(与 B 站录播姬 .xml 双格式自动发现,抖音主播的录播从此也有弹幕证据)、互动事件计权(SC/舰长/礼物/关注/点赞按档加权——花钱和动手的票比弹幕硬)、反刷屏(同一人单窗贡献封顶)、突发加成(相对前一窗跳升计分——爆点是「突然炸」)、信号融合升级(多路共振加成+内容自适应窗口)、弹幕引导采样(表情/语气这类贵模型的算力优先花在观众炸锅处);修复真机预览黑屏(多个 video 同载同一本地流 URL 在 Chromium 撞车)与胶片带缩略图被 CSP 拦截

历史版本(v0.4.3 → v0.14.1)与里程碑一览
  • v0.14.1(2026-08-11)「想得再深、也得出片」:修复「找爆点失败:LLM 未返回内容」(#8)——深度思考型模型把 4000 token 输出预算全烧在思考上、正文为空;检测到「只思考没正文」自动换 16000 大预算重试一次,正文错放 reasoning 字段的兜底取回,仍失败按证据分因报错(烧完预算/安全审查拦截/服务端空响应),每条写明下一步
  • v0.14.0(2026-08-09)「发得出去、活得下来」:变形度评分(本次导出实际做的变形汇总一个分,出片前实时预估、低于 40 黄牌——像素级搬运是 2026 判搬运第一死因);AI 封面双档(按标题生竖版大字封面:Seedream 走量约 ¥0.3/张、Nano Banana Pro 精品约 ¥1/张,复用 Atlas Key);AI 配乐(按品类生成版权安全纯音乐,自动挂进 BGM 混音链);剪映草稿导出(每条切片一个草稿夹,AI 切点全铺进时间轴);说话人标签字幕(彩色「A:」「B:」行首标签);实用密度加分(步骤/清单/数字密集的片标「可收藏」,吃 7 天慢推流);分发台账与留证包(源片区间 CSV 对账+前后 3 分钟源片存档);AIGC 标注助手(按平台给标注文案与入口;超 5 条提示限产);多版反指纹(末版换 flash-forward 开场+模板种子化微扰);保留呼吸口(跳剪可留 0.25 秒停顿);实验性 Linux AppImage(#7)
  • v0.13.0(2026-08-09)「整场看完、敢扔」:质量门三档(零上下文终判建议发/需人审/弃+规则层抓硬伤;判弃折叠可捞回,无人值守只自动导「建议发」档);全场画面扫描(每 30 秒一帧看完整场,画面事件进选段证据;本机免费/云端整场几毛);点题选段(自然语言说要什么不要什么);主播口令打点(「这段剪下来」当最强证据);带货三段式(痛点→演示→价格散点自动拼);文稿选段(点句成片:搜台词/按说话人筛/跨段任选);配置预检(连不上 AI 当场拦下给下一步,#6)
  • v0.12.0(2026-08-05)「挑得准、开场炸」:爆点闪现(正片前先闪 0.3-1 秒最炸瞬间再切回,与高潮前置自动二选一);AI 画面复核(头部候选抽九宫格接触表让视觉模型过目:画面分回流排序、货不对板标警告;本机 Ollama 免费,填 Key 切云端);精准切点(Paraformer 二遍解码词级时间戳 ±50ms,修字幕/跳剪/切点,对不上自动回退);钩子兑付校验(钩子承诺的数字必须真出现在片中);字幕现代化(默认换关键词高亮,逐词弹色升级当前词点亮+阻尼弹入);修复 4 个从未生效的导出开关
  • v0.11.0(2026-08-05)「切完就能发」:平台发布包(导出后按平台整理齐套素材:硬链接视频+按平台画幅重裁封面+按平台上限适配文案,manifest 记录适配项);一片多版(同片 2-3 版差异化包装:换角度标题/悬念句/文案/封面峰,变体标 variantOf,合集与 EDL 只收原版);音效打点与 BGM(whoosh 卡切缝、「叮」卡情绪峰、钩子上屏轻响,每条最多 3 个;BGM 循环铺满+人声闪避+结尾淡出,独立后处理趟零画质损失);动态极简字幕样式
  • v0.10.1(2026-08-05)「换得了模型、扛得住抽风」:AI 模型入口常驻——此前配好一次之后就再也换不了供应商/模型(只有检测报错时才露出那个面板),v0.10.0 新加的 7 家供应商老用户根本点不到;现在工具条上常驻一个写着当前模型名的按钮,随时能换,换完确认会按新模型重跑一次;LLM 吐坏 JSON 自动重试一次(实测主流服务商偶发杂质 token,整轮检测直接失败);信号通道收敛提名数(12 个高能时刻会让模型交白卷,收敛到 8 个)
  • v0.10.0(2026-08-05)「挑得准一点」:切片选段质量重做——支持多片段拼接(把相隔十几分钟的两处摆一起,「前后打脸」这类爆点才成立;剪映的 AI 切片也只做连续区间);直播品类判据照 B站/抖音真实分区重排(补上虚拟主播、电台、萌宠、美食、赛事、手工、一起看等此前整块缺失的品类,一起看类明确禁止切影视画面本身);新增信号驱动候选——跳舞/萌宠/户外这类文字稿是空的、原本一条候选都出不来,现在按画面与声音信号定位高能时刻;笑声不再当爆点本身(它是滞后结果,包袱在它之前)。另有语气与笑声掌声两路新证据、自动运镜剪重录录播姬/blrec webhookLLM 多供应商预设(DeepSeek 官方/百炼/GLM/Kimi/硅基流动/OpenRouter/OpenAI)与模型清单一键拉取(模型 id 会随厂商换代失效,直接问端点要真实清单)
  • v0.9.4(2026-07-31)「中文用户名不再背锅」:修复 Windows 中文用户名下转写必失败(#4)——模型路径自动转 8.3 短路径、音频样本改应用侧读入;跨盘搬模型不再被误拦;模型加载失败给对症提示
  • v0.9.3(2026-07-28)「东西存哪儿、出多大,你说了算」:设置页上线(#3)——模型存放位置可见可搬家、导出画质三档(省空间档小 66%)、默认字幕样式与导出位置收进设置
  • v0.9.2(2026-07-27)「报错说人话、界面不挤乱」:转写失败对症归因(#2);出片选项条自动换行不再撑破界面;导出位置可自选(#3)
  • v0.9.1(2026-07-24)「Windows 首启修复」:修复模型下载 100% 又从头开始的循环(Windows tar 不支持 bzip2,内置纯 JS 解压兜底);解压进度条;临时目录原子落位
  • v0.9.0(2026-07-24)「越用越懂你、装完就能跑」:审阅反馈回流(采用/否决自动进本地偏好档)+ doctor 环境自检 + 模型下载断点续传 + 发布文案角度模板(8 钩子角度×5 CTA)+ 参考爆款入口补全
  • v0.8.0(2026-07-20)「照着爆款切、坏片自己修」:参考视频驱动 + 出片自我修复 + 平台违禁词 lint(120+ 规则)+ Hormozi 大字字幕 + 抽帧接触表(VLM 调用 20→3)
  • v0.7.0(2026-07-16)「切完自检、随叫随剪」:出片自我质检 + Headless CLI 与官方 Agent Skill + 精华合集 + 高潮前置 + 一键双画幅 + 商品讲解模式
  • v0.6.0(2026-07-10)「看得见画面、接得上生态」:六路证据链(+视觉/表情/弹幕)+ 双语字幕 + 本地 MCP Server + 录播监听 + 发布三件套
  • v0.5.0(2026-07-09)「选得准、批量稳」:切片审阅台 + 镜头切点吸附 + 品牌样式模板 + 端侧两级漏斗
  • v0.4.3(2026-07-06)工程底座:转写本地缓存 + clips.json 处理回执
里程碑状态
桌面客户端 · 本地转写三档 · AI 找爆点 · 竖屏+字幕成片 · 舒适智能构图✅ 已完成
说话人分离 · 气泡字幕 · 气口跳剪 · 一键全托管 · 安装包发布✅ 已完成
v0.5 ~ v0.9(审阅台 · MCP · 录播监听 · 质检修复 · 反馈回流 · 设置页)✅ 已发布
v0.10 ~ v0.14(多片段拼接 · 品类判据 · 质量门三档 · 平台发布包 · 一片多版 · 剪映草稿 · 变形度评分 · AI 封面/配乐)✅ 已发布
v0.15(三栏工作台 · 时间轴曲线 · 弹幕互动计权)✅ 已发布
v0.15.1(硬件加速 · URL 导入 · 断点恢复 · 持久队列 · 发布反馈 · 健康检查 · 主题系列)✅ 已发布
v0.16(项目工作区 · 可逆编辑 · 专业快捷键 · 本地 A/B 实验)✅ 已发布
v0.17(有界渲染缓存 · 关键帧安全直拷 · 全入口共享 · 缓存诊断清理)✅ 已发布
v0.18 ~ v0.27(质量评测 · 字幕质量门 · 多模态/屏显文字证据 · 舒适竖屏构图 · 成片质检 · 智能画面校正 · HDR 安全转 SDR · 同轨分析 · 质量封面 · 语音安全切点 · 48k 智能人声增强)✅ 已发布
英文 ASR 升级(Parakeet)· 代码签名 · 无人值守增强🗺️ 规划中

完整更新历史见 Releases · 想投票决定先做哪个?到 Discussions 留言。

常见问题

有什么免费的 AI 切片 / AI 剪辑软件? HotClip 就是——免费开源(AGPL-3.0)、本地运行的 AI 剪辑 / 视频切片工具,把长视频、直播回放一键切成竖屏短视频,无水印、无积分制、不限时长,Windows / macOS / Linux(实验)都有安装包。

直播回放 / 播客怎么一键剪成抖音、B站短视频? 导入文件 → AI 转写并自动识别高光片段(可手动增删调边界)→ 一键导出竖屏 9:16 成片,自带字幕、标题贴片和封面图,直接上传抖音 / 快手 / B站 / 视频号 / 小红书。

AI 剪辑会上传我的视频吗?需要联网吗? 不上传。转写、字幕、切片、导出全程在你自己的电脑上离线完成。只有「AI 找爆点」这一步默认调用云端大模型(只发文字稿,用你自己的 Key),接本机 Ollama 后 100% 离线。

能自动加字幕吗? 能。逐词同步的动态字幕直接烧进画面,关键词高亮/大字弹出/气泡特效等多款样式一档切换,也可导出 SRT 给平台原生上传;开双语字幕还能整句翻译烧成第二行。

能自动剪掉口播里的停顿和口头禅吗?视频如何去气口? 能。「剪气口」自动删掉说话间的静音停顿,「剪口头禅」剪掉嗯/呃与结巴重复——剪了什么逐条写进 clips.json,你始终知道 AI 动了哪里。

弹幕能参与选爆点吗?直播高光怎么找? 能,而且是最硬的证据。HotClip 自动发现录播旁的弹幕文件——B 站录播姬的同名 .xml、抖音直播录制工具的弹幕 .jsonl 都认;弹幕密度、SC / 舰长 / 礼物 / 关注 / 点赞互动直接进爆点判断(单人刷屏有封顶,突然爆发有加成)。没有弹幕文件也不要紧,响度 / 镜头 / 运动 / 表情 / 语气 / 笑声等信号照样兜底。

剪映可以自动切割片段吗?和 HotClip 怎么配合? 剪映的智能切片在会员档,且只能切连续区间。HotClip 免费开源、支持把相隔十几分钟的片段拼成一条,还能把每条切片导出成剪映草稿——AI 粗剪交给 HotClip,打开剪映接着精修,不冲突,是接力。

HotClip 和剪映 / OpusClip / Klap 这类工具的区别? 最大区别是素材不出你的电脑:OpusClip 等 SaaS 必须上传云端、按源视频分钟扣积分(积分月底清零),免费档带水印;剪映的智能切片等核心能力在会员档。HotClip 开源免费、本地处理、无水印、不限时长,AI 切点附理由可审计。详见上方对比表

支持中文视频吗?方言、粤语呢? 支持且是强项。中文识别走专用引擎(SenseVoice/Paraformer/FireRedASR2),准确率显著高于通用模型;方言、粤语、中英混说都覆盖,界面、字幕、prompt 都针对中文内容做了适配。

需要显卡吗?配置要求高吗? 不需要。本地转写用 int8 量化小模型,普通 CPU 就能跑;找爆点的大模型在云端(或你本机的 Ollama)。

可以切别人的直播吗?直播切片如何申请授权? HotClip 面向你自己的内容或已获授权的切片。切别人的直播请先拿到授权(如各平台/公会的主播切片授权计划);未经授权的影视/直播搬运不受支持,也不欢迎。

首次使用,语音模型下载到 100% 又从头开始怎么办? 升级到 v0.9.1 或更新版本即可,老版本的 Windows 解压 bug 已彻底修复;旧版已下载的字节还会自动续传。

开发者

git clone https://github.com/xixihhhh/hotclip.git
cd hotclip
pnpm install
pnpm dev        # 启动桌面应用(开发模式)
pnpm test       # 跑单元测试

技术栈:Electron + React 19 + TypeScript + Tailwind 4 · ffmpeg(打包内置)· sherpa-onnx 本地转写 + 说话人分离 · libass 动态字幕 + 离屏 Chromium 气泡字幕引擎 · LLM 爆点检测(Atlas Cloud / Ollama / 任意 OpenAI 兼容接口,BYO Key)

站在这些开源项目的肩膀上
项目在 HotClip 中的角色
sherpa-onnx本地语音识别运行时(纯 CPU 可跑)
SenseVoice / FunASR五语种快速转写 / Paraformer 中文转写与标点
FireRedASR最高精度档:普通话/方言/中英混说
pyannote-audio + 3D-Speaker说话人分离(本地零上传)
FFmpeg + libass帧精确切割 / 字幕烧录
onnxruntime端侧模型推理

授权与边界

  • 代码:AGPL-3.0-only
  • HotClip 面向你自己的内容已获授权的切片(如主播切片授权计划)。请遵守各平台二创与授权规则——未经授权的影视/直播搬运不受支持,也不欢迎。

社区与同作者项目

  • 🐛 提 Bug / 安装求助 · 💡 功能建议与 Roadmap
  • 🔨 ClipForge — 开源 AI 带货短视频神器:上传一张商品图,AI 提炼卖点、写脚本、配画面配音字幕,一键产出卖货视频。HotClip 把长视频切成爆款,ClipForge 从一张图造出短视频,做电商/带货的朋友可以配着用

Star History Chart

⭐ 觉得有用就点个 Star——Star + Watch 第一时间收到新版本通知,每颗星都是让更多人不用再给积分制付费的一票。

Contributors

xixihhhh

177 commits

Languages

TypeScript

99.3%