视频转字幕、字幕翻译、AI 配音与声音克隆、字幕烧录——免费开源的一站式桌面工具。基于 Whisper / FunASR 等本地模型离线语音转文字,批量处理 + 全平台 GPU 加速,跨 Windows / macOS / Linux。Free, open-source desktop app to generate, translate, dub & burn video subtitles — local Whisper speech-to-text, AI dubbing & voice cloning, offline, GPU-accelerated.
See the code视频转字幕、字幕翻译、AI 创作助手、AI 配音与声音克隆、字幕烧录、MCP/CLI 自动化——一站式开源桌面工具
让每一帧画面都能美妙地表达

妙幕(SmartSub)是一款开源的音视频字幕与配音工具,把「语音转文字 → 字幕翻译 → 校对润色 → TTS 配音 → 烧录合成」整条流水线装进一个桌面应用,还内置在线视频下载,粘贴 B 站 / YouTube 等平台链接即可直接取材。转写基于 whisper.cpp、sherpa-onnx 等本地模型完成,文件不出本机;支持批量处理,支持 NVIDIA / AMD / Intel / Apple Silicon 硬件加速,可在 Windows、macOS、Linux 上运行。
妙幕深度融合了现代 AI 协同与 Agentic 自动化能力:
整条流水线可以完全免费跑通:本地模型转写、内置免费翻译源、本地 TTS 配音(含声音克隆)、本地 ffmpeg 烧录——不需要 API Key,本地环节也没有用量限制。同时可按需接入 20 个翻译服务、9 家云端听写、6 类云端配音服务作为增强。
| 你想做的事 | 妙幕的做法 |
|---|---|
| 用自然语言搞定字幕编辑与排障 | 随时呼出内置 AI 助手,上下文感知与多模态截图诊断,一句话润色、改口语化或自动下发任务 |
| 让 Cursor / Claude / 脚本接管音视频流水线 | 借助 111 个 MCP 工具与 CLI 命令,外部 AI Agent 或终端脚本直接全自动批量转写、翻译、配音与合成 |
| 看无字幕的外语视频、公开课 | 拖入视频,本地转写并翻译,得到双语字幕,播放器直接挂载 |
| 给 B 站 / YouTube 在线视频配字幕 | 粘贴链接应用内直接下载,官方字幕自动配对,无需第三方下载工具 |
| 做视频出海 / 多语言内容 | 字幕翻译成目标语言,再用 TTS 配成外语音轨,导出成品视频 |
| 用自己的声音给视频配音 | 录一段参考音频,零样本克隆音色,整条视频用你的声音朗读 |
| 整理播客、网课、会议录音 | 批量转写成 SRT 字幕文件,供剪辑、检索或存档 |
| 给成片压制字幕 | 校对台逐句核对后硬烧或软封装,样式所见即所得 |
在线视频下载 / 本地音视频 → 转写 → 翻译 → 校对 → 配音 → 合成导出。每一步都可以独立使用,也可以串成流水线批量执行;更能通过内置 AI 创作助手实时对话协作,或通过 MCP / CLI 交由外部 AI 智能体全自动化调度。
⌘J(macOS)/ Ctrl+J(Windows、Linux)随时呼出右侧抽屉面板,支持调整宽度,会话记录自动持久化保存在本地smartsub 统一命令行入口,支持复杂任务流水线一键编排(pipeline.run)、JSON / stdin 管道传参、任务状态轮询与去重机制,让音视频生产轻松融入 Shell 脚本与 CI/CD 自动化。详见 MCP 与 CLI 接入指南whisper.cpp、faster-whisper、FunASR、Qwen3-ASR、FireRedASR、NVIDIA Parakeet、本地 Whisper CLI,以及免 GPU 的云端听写(9 家服务商)除了常规界面操作外,妙幕提供了强大的智能化副驾体验与开发者级自动化支持:
smartsub CLI 批量处理大规模音视频流水线。| 视频合成(字幕烧录) | 字幕校对 |
|---|---|
![]() | ![]() |
对价格敏感的用户,下面这条路线不花一分钱,也不需要注册任何服务:
| 环节 | 免费方案 | 说明 |
|---|---|---|
| 视频下载 | yt-dlp / lux 开源引擎 | 应用内一键安装,免费使用 |
| 语音转写 | whisper.cpp / faster-whisper / FunASR / Qwen3-ASR / FireRedASR / Parakeet 本地模型 | 模型下载一次,离线可用 |
| 字幕翻译 | 内置免费翻译(必应 / 谷歌接口,自动回退)、Ollama 本地大模型、DeepLX | 免费翻译开箱即用,零配置 |
| TTS 配音 | 本地 Kokoro / VITS / ZipVoice 声音克隆;Edge TTS 免费档 | 本地模型离线合成,无用量限制 |
| 字幕烧录 | 内置 ffmpeg | 本地合成 |
付费云服务(OpenAI、ElevenLabs、火山引擎、腾讯云等)全部是可选增强,按需选用。
根据电脑系统和芯片选择安装包。GPU 加速包无须在下载时选择,安装后在应用内按需下载。
| 系统 | 芯片 | 安装包 | 说明 |
|---|---|---|---|
| Windows | x64 | windows-x64 | NVIDIA 用 CUDA,AMD / Intel 用 Vulkan,应用内下载 |
| macOS | Apple | mac-arm64 | 自动启用 Core ML / Metal 加速 |
| macOS | Intel | mac-x64 | 仅 CPU,不支持 GPU 加速 |
| Linux | x64 | linux-x64 | NVIDIA 用 CUDA,AMD / Intel 用 Vulkan,应用内下载 |
下载入口:GitHub Releases | 夸克网盘
macOS 用户推荐使用 Homebrew 安装,会自动匹配芯片类型:
brew tap buxuku/tap # 只需执行一次
brew install --cask smartsub # 安装
brew upgrade --cask smartsub # 升级
转写引擎可逐任务切换,运行时与模型在「引擎与模型」页面统一管理:
| 引擎 | 说明 | 运行方式 |
|---|---|---|
| whisper.cpp(内置) | 默认引擎,支持 ggml 量化模型与 GPU 加速 | 随应用内置,开箱即用 |
| faster-whisper | 基于 CTranslate2,速度更快,模型按需从 HuggingFace 下载 | 自包含 Python 运行时(应用内下载) |
| FunASR | SenseVoice(中 / 英 / 日 / 韩 / 粤)与 Paraformer-zh,中文表现优秀 | 内置 sherpa-onnx 原生库 |
| Qwen3-ASR | 通义千问语音识别(qwen3-asr-0.6b / 1.7b) | 内置 sherpa-onnx 原生库 |
| FireRedASR | FireRedASR-AED large(中英),中文表现优秀 | 内置 sherpa-onnx 原生库 |
| NVIDIA Parakeet | 英语 TDT v2、多语种 TDT v3(25 种欧洲语言)、日语 0.6B CTC,支持标点 | 内置 sherpa-onnx 原生库 |
| 本地 Whisper CLI | 调用你自行安装的 whisper 兼容命令 | 使用系统已装命令 |
| 云端听写(在线 ASR) | 9 家在线服务商,免 GPU、支持多服务商多实例 | 在线服务(音频上传到你配置的端点) |
FunASR / Qwen3-ASR / FireRedASR / Parakeet 均通过内置的 sherpa-onnx 原生库运行,无需额外环境;faster-whisper 会在应用内下载一个自包含运行时。
云端听写在「引擎与模型」左栏的「云端听写」分组中配置。每个服务商是一个独立入口,选中即见配置表单,填入凭据即可(支持「测试连接」)。转写时音频会上传到你配置的端点,首次运行有隐私确认——请勿用于敏感内容,并留意服务商的用量费用。
audio/transcriptions 协议(whisper-1、gpt-4o-transcribe 等)。OpenAI / Groq / 硅基流动预设直接列在侧栏,其它兼容端点(自建服务、中转站)经「添加自定义」接入,可添加多个scribe_v1 模型nova-2 / nova-3 模型mimo-v2.5-asr,中英文与中文方言;按时长计费,使用 20 秒静音分片生成粗粒度时间轴whisper.cpp / faster-whisper 使用 whisper 系列模型,模型越大越准、越慢、越吃显存:
tiny / base,速度快、占用小small / base 起步,平衡精度与资源large 系列,精度最高en 的模型,专为英语优化q5 / q8 量化版本,牺牲少量精度换取更小体积软件内置 GPU 加速包管理,无须手动安装 CUDA Toolkit。安装后在「引擎与模型」页面管理 GPU 加速,软件会自动检测显卡并推荐合适的加速方案。
| 平台 | 加速后端 | 说明 |
|---|---|---|
| Windows / Linux + NVIDIA | CUDA | 支持 CUDA 11.8.0 / 12.2.0 / 12.4.0 / 13.0.2,应用内下载对应加速包 |
| Windows / Linux + AMD / Intel | Vulkan | 应用已内置 Vulkan 加速包 |
| macOS(Apple 芯片) | Core ML / Metal | 下载 mac arm64 版本后自动启用 |
| 任意平台 | CPU | 无可用 GPU 时自动回退 |
使用云端翻译服务需要相应的 API 密钥或配置。百度翻译、火山引擎等服务的 API 申请方法可参考 Bob 的服务申请文档,感谢 Bob 这款优秀的软件。
AI 翻译的结果受模型和提示词影响较大,可以尝试不同的模型和提示词组合,找到适合自己的搭配。
每个 AI 翻译服务都支持自定义参数配置,精确控制模型行为:
本地引擎基于 sherpa-onnx 运行,完全离线免费:
| 模型 | 语言 | 音色 | 说明 |
|---|---|---|---|
| Kokoro 多语 v1.1 | 中 / 英 | 103 | 多语模型,英文与中文音色均衡 |
| VITS 中文 AIShell3 | 中 | 174 | 中文说话人库 |
| ZipVoice 声音克隆 | 中 / 英 | 用户自建 | 零样本克隆:一段参考音频 + 对应文本即建即用 |
云端服务商按需接入:
| 服务 | 说明 |
|---|---|
| Edge TTS | 免费、无需 Key;属逆向接口试用档,不承诺可用性,断供时建议切换其它引擎 |
| OpenAI 兼容 | audio/speech 协议,内置 OpenAI / 硅基流动预设,可添加多个自定义端点 |
| Azure Speech | 微软 Neural 音色体系(700+ 音色),SSML 语速控制 |
| 火山引擎豆包 | 豆包语音合成大模型音色,支持声音复刻 2.0 克隆音色 |
| ElevenLabs | 多语模型,支持即时声音克隆(IVC) |
| Xiaomi MiMo | mimo-v2.5-tts,8 个中英文预置音色,当前限时免费 |
时间轴对齐机制:合成前按目标时长预控语速,合成后实测时长复核(本地引擎免费重合成,云端用 atempo 变速),不足时向相邻静音间隙借用时间;仍超过 1.5 倍语速红线的行进入人工处理清单,可改文案、单行重生成或接受变速。
创建克隆音色时会自动质检参考音频(时长、信噪比、削波、音量等),给出问题定位与修复建议。
⌘J(macOS)或 Ctrl+J(Windows / Linux)可随时呼出或收起右侧 AI 助手面板,展开后自动聚焦输入框。在软件中打开 设置 → 连接 AI 工具(MCP):
~/.codex/config.toml 中。# macOS
"/Applications/SmartSub.app/Contents/Resources/automation/smartsub" setup cli --install
"$HOME/.local/bin/smartsub" setup mcp --client claude --install
smartsub 条目合并到客户端的 mcpServers 字段中即可。无需额外安装 Node.js!详细使用指引请参阅 AI 助手使用文档 与 MCP 与 CLI 接入指南。
模型文件较大,如果应用内下载困难,可以手动下载后导入。whisper 模型下载源:
苹果芯片需同时下载模型对应的 encoder.mlmodelc 文件,解压后放在模型相同目录下(q5 / q8 系列模型无须此文件)。
导入步骤:在「引擎与模型」页面点击「导入模型」,选择下载好的模型文件确认导入;或直接复制到模型目录。
FunASR / Qwen3-ASR / FireRedASR / Parakeet 等引擎的模型可在「引擎与模型」页面内按需下载(支持 ModelScope / GitHub 等多源)。
在终端中执行以下命令后重新运行应用:
sudo xattr -dr com.apple.quarantine /Applications/SmartSub.app
在「引擎与模型」页面把加速模式切换为「仅 CPU」,或改用其它转写引擎;诊断面板会给出失败原因。
欢迎提交 Issue 和 Pull Request 改进这个项目。
git clone https://github.com/buxuku/SmartSub.git
cd SmartSub
yarn install
yarn dev
如原生依赖自动下载失败(网络受限等),可手动执行 yarn native:fetch 重试。
本项目由以下赞助商支持:
如果这个项目对你有帮助,欢迎点一个 star,或者请作者喝一杯咖啡(请备注你的 GitHub 账号)。使用中有任何问题,欢迎加入 QQ 交流群(群号:655348339)。
| 支付宝收款码 | 微信赞赏码 | QQ 交流群 |
|---|---|---|
![]() | ![]() | ![]() |
本项目采用 MIT 许可证,详情见 LICENSE 文件。
4,879 followers · starred Feb 2025
96 followers · starred Jul 2024
1 followers · starred Feb 2025
25 followers · starred Feb 2025
TypeScript
83.5%
JavaScript
15.0%
Python
1.1%
视频转字幕、字幕翻译、AI 配音与声音克隆、字幕烧录——免费开源的一站式桌面工具。基于 Whisper / FunASR 等本地模型离线语音转文字,批量处理 + 全平台 GPU 加速,跨 Windows / macOS / Linux。Free, open-source desktop app to generate, translate, dub & burn video subtitles — local Whisper speech-to-text, AI dubbing & voice cloning, offline, GPU-accelerated.
See the code视频转字幕、字幕翻译、AI 创作助手、AI 配音与声音克隆、字幕烧录、MCP/CLI 自动化——一站式开源桌面工具
让每一帧画面都能美妙地表达

妙幕(SmartSub)是一款开源的音视频字幕与配音工具,把「语音转文字 → 字幕翻译 → 校对润色 → TTS 配音 → 烧录合成」整条流水线装进一个桌面应用,还内置在线视频下载,粘贴 B 站 / YouTube 等平台链接即可直接取材。转写基于 whisper.cpp、sherpa-onnx 等本地模型完成,文件不出本机;支持批量处理,支持 NVIDIA / AMD / Intel / Apple Silicon 硬件加速,可在 Windows、macOS、Linux 上运行。
妙幕深度融合了现代 AI 协同与 Agentic 自动化能力:
整条流水线可以完全免费跑通:本地模型转写、内置免费翻译源、本地 TTS 配音(含声音克隆)、本地 ffmpeg 烧录——不需要 API Key,本地环节也没有用量限制。同时可按需接入 20 个翻译服务、9 家云端听写、6 类云端配音服务作为增强。
| 你想做的事 | 妙幕的做法 |
|---|---|
| 用自然语言搞定字幕编辑与排障 | 随时呼出内置 AI 助手,上下文感知与多模态截图诊断,一句话润色、改口语化或自动下发任务 |
| 让 Cursor / Claude / 脚本接管音视频流水线 | 借助 111 个 MCP 工具与 CLI 命令,外部 AI Agent 或终端脚本直接全自动批量转写、翻译、配音与合成 |
| 看无字幕的外语视频、公开课 | 拖入视频,本地转写并翻译,得到双语字幕,播放器直接挂载 |
| 给 B 站 / YouTube 在线视频配字幕 | 粘贴链接应用内直接下载,官方字幕自动配对,无需第三方下载工具 |
| 做视频出海 / 多语言内容 | 字幕翻译成目标语言,再用 TTS 配成外语音轨,导出成品视频 |
| 用自己的声音给视频配音 | 录一段参考音频,零样本克隆音色,整条视频用你的声音朗读 |
| 整理播客、网课、会议录音 | 批量转写成 SRT 字幕文件,供剪辑、检索或存档 |
| 给成片压制字幕 | 校对台逐句核对后硬烧或软封装,样式所见即所得 |
在线视频下载 / 本地音视频 → 转写 → 翻译 → 校对 → 配音 → 合成导出。每一步都可以独立使用,也可以串成流水线批量执行;更能通过内置 AI 创作助手实时对话协作,或通过 MCP / CLI 交由外部 AI 智能体全自动化调度。
⌘J(macOS)/ Ctrl+J(Windows、Linux)随时呼出右侧抽屉面板,支持调整宽度,会话记录自动持久化保存在本地smartsub 统一命令行入口,支持复杂任务流水线一键编排(pipeline.run)、JSON / stdin 管道传参、任务状态轮询与去重机制,让音视频生产轻松融入 Shell 脚本与 CI/CD 自动化。详见 MCP 与 CLI 接入指南whisper.cpp、faster-whisper、FunASR、Qwen3-ASR、FireRedASR、NVIDIA Parakeet、本地 Whisper CLI,以及免 GPU 的云端听写(9 家服务商)除了常规界面操作外,妙幕提供了强大的智能化副驾体验与开发者级自动化支持:
smartsub CLI 批量处理大规模音视频流水线。| 视频合成(字幕烧录) | 字幕校对 |
|---|---|
![]() | ![]() |
对价格敏感的用户,下面这条路线不花一分钱,也不需要注册任何服务:
| 环节 | 免费方案 | 说明 |
|---|---|---|
| 视频下载 | yt-dlp / lux 开源引擎 | 应用内一键安装,免费使用 |
| 语音转写 | whisper.cpp / faster-whisper / FunASR / Qwen3-ASR / FireRedASR / Parakeet 本地模型 | 模型下载一次,离线可用 |
| 字幕翻译 | 内置免费翻译(必应 / 谷歌接口,自动回退)、Ollama 本地大模型、DeepLX | 免费翻译开箱即用,零配置 |
| TTS 配音 | 本地 Kokoro / VITS / ZipVoice 声音克隆;Edge TTS 免费档 | 本地模型离线合成,无用量限制 |
| 字幕烧录 | 内置 ffmpeg | 本地合成 |
付费云服务(OpenAI、ElevenLabs、火山引擎、腾讯云等)全部是可选增强,按需选用。
根据电脑系统和芯片选择安装包。GPU 加速包无须在下载时选择,安装后在应用内按需下载。
| 系统 | 芯片 | 安装包 | 说明 |
|---|---|---|---|
| Windows | x64 | windows-x64 | NVIDIA 用 CUDA,AMD / Intel 用 Vulkan,应用内下载 |
| macOS | Apple | mac-arm64 | 自动启用 Core ML / Metal 加速 |
| macOS | Intel | mac-x64 | 仅 CPU,不支持 GPU 加速 |
| Linux | x64 | linux-x64 | NVIDIA 用 CUDA,AMD / Intel 用 Vulkan,应用内下载 |
下载入口:GitHub Releases | 夸克网盘
macOS 用户推荐使用 Homebrew 安装,会自动匹配芯片类型:
brew tap buxuku/tap # 只需执行一次
brew install --cask smartsub # 安装
brew upgrade --cask smartsub # 升级
转写引擎可逐任务切换,运行时与模型在「引擎与模型」页面统一管理:
| 引擎 | 说明 | 运行方式 |
|---|---|---|
| whisper.cpp(内置) | 默认引擎,支持 ggml 量化模型与 GPU 加速 | 随应用内置,开箱即用 |
| faster-whisper | 基于 CTranslate2,速度更快,模型按需从 HuggingFace 下载 | 自包含 Python 运行时(应用内下载) |
| FunASR | SenseVoice(中 / 英 / 日 / 韩 / 粤)与 Paraformer-zh,中文表现优秀 | 内置 sherpa-onnx 原生库 |
| Qwen3-ASR | 通义千问语音识别(qwen3-asr-0.6b / 1.7b) | 内置 sherpa-onnx 原生库 |
| FireRedASR | FireRedASR-AED large(中英),中文表现优秀 | 内置 sherpa-onnx 原生库 |
| NVIDIA Parakeet | 英语 TDT v2、多语种 TDT v3(25 种欧洲语言)、日语 0.6B CTC,支持标点 | 内置 sherpa-onnx 原生库 |
| 本地 Whisper CLI | 调用你自行安装的 whisper 兼容命令 | 使用系统已装命令 |
| 云端听写(在线 ASR) | 9 家在线服务商,免 GPU、支持多服务商多实例 | 在线服务(音频上传到你配置的端点) |
FunASR / Qwen3-ASR / FireRedASR / Parakeet 均通过内置的 sherpa-onnx 原生库运行,无需额外环境;faster-whisper 会在应用内下载一个自包含运行时。
云端听写在「引擎与模型」左栏的「云端听写」分组中配置。每个服务商是一个独立入口,选中即见配置表单,填入凭据即可(支持「测试连接」)。转写时音频会上传到你配置的端点,首次运行有隐私确认——请勿用于敏感内容,并留意服务商的用量费用。
audio/transcriptions 协议(whisper-1、gpt-4o-transcribe 等)。OpenAI / Groq / 硅基流动预设直接列在侧栏,其它兼容端点(自建服务、中转站)经「添加自定义」接入,可添加多个scribe_v1 模型nova-2 / nova-3 模型mimo-v2.5-asr,中英文与中文方言;按时长计费,使用 20 秒静音分片生成粗粒度时间轴whisper.cpp / faster-whisper 使用 whisper 系列模型,模型越大越准、越慢、越吃显存:
tiny / base,速度快、占用小small / base 起步,平衡精度与资源large 系列,精度最高en 的模型,专为英语优化q5 / q8 量化版本,牺牲少量精度换取更小体积软件内置 GPU 加速包管理,无须手动安装 CUDA Toolkit。安装后在「引擎与模型」页面管理 GPU 加速,软件会自动检测显卡并推荐合适的加速方案。
| 平台 | 加速后端 | 说明 |
|---|---|---|
| Windows / Linux + NVIDIA | CUDA | 支持 CUDA 11.8.0 / 12.2.0 / 12.4.0 / 13.0.2,应用内下载对应加速包 |
| Windows / Linux + AMD / Intel | Vulkan | 应用已内置 Vulkan 加速包 |
| macOS(Apple 芯片) | Core ML / Metal | 下载 mac arm64 版本后自动启用 |
| 任意平台 | CPU | 无可用 GPU 时自动回退 |
使用云端翻译服务需要相应的 API 密钥或配置。百度翻译、火山引擎等服务的 API 申请方法可参考 Bob 的服务申请文档,感谢 Bob 这款优秀的软件。
AI 翻译的结果受模型和提示词影响较大,可以尝试不同的模型和提示词组合,找到适合自己的搭配。
每个 AI 翻译服务都支持自定义参数配置,精确控制模型行为:
本地引擎基于 sherpa-onnx 运行,完全离线免费:
| 模型 | 语言 | 音色 | 说明 |
|---|---|---|---|
| Kokoro 多语 v1.1 | 中 / 英 | 103 | 多语模型,英文与中文音色均衡 |
| VITS 中文 AIShell3 | 中 | 174 | 中文说话人库 |
| ZipVoice 声音克隆 | 中 / 英 | 用户自建 | 零样本克隆:一段参考音频 + 对应文本即建即用 |
云端服务商按需接入:
| 服务 | 说明 |
|---|---|
| Edge TTS | 免费、无需 Key;属逆向接口试用档,不承诺可用性,断供时建议切换其它引擎 |
| OpenAI 兼容 | audio/speech 协议,内置 OpenAI / 硅基流动预设,可添加多个自定义端点 |
| Azure Speech | 微软 Neural 音色体系(700+ 音色),SSML 语速控制 |
| 火山引擎豆包 | 豆包语音合成大模型音色,支持声音复刻 2.0 克隆音色 |
| ElevenLabs | 多语模型,支持即时声音克隆(IVC) |
| Xiaomi MiMo | mimo-v2.5-tts,8 个中英文预置音色,当前限时免费 |
时间轴对齐机制:合成前按目标时长预控语速,合成后实测时长复核(本地引擎免费重合成,云端用 atempo 变速),不足时向相邻静音间隙借用时间;仍超过 1.5 倍语速红线的行进入人工处理清单,可改文案、单行重生成或接受变速。
创建克隆音色时会自动质检参考音频(时长、信噪比、削波、音量等),给出问题定位与修复建议。
⌘J(macOS)或 Ctrl+J(Windows / Linux)可随时呼出或收起右侧 AI 助手面板,展开后自动聚焦输入框。在软件中打开 设置 → 连接 AI 工具(MCP):
~/.codex/config.toml 中。# macOS
"/Applications/SmartSub.app/Contents/Resources/automation/smartsub" setup cli --install
"$HOME/.local/bin/smartsub" setup mcp --client claude --install
smartsub 条目合并到客户端的 mcpServers 字段中即可。无需额外安装 Node.js!详细使用指引请参阅 AI 助手使用文档 与 MCP 与 CLI 接入指南。
模型文件较大,如果应用内下载困难,可以手动下载后导入。whisper 模型下载源:
苹果芯片需同时下载模型对应的 encoder.mlmodelc 文件,解压后放在模型相同目录下(q5 / q8 系列模型无须此文件)。
导入步骤:在「引擎与模型」页面点击「导入模型」,选择下载好的模型文件确认导入;或直接复制到模型目录。
FunASR / Qwen3-ASR / FireRedASR / Parakeet 等引擎的模型可在「引擎与模型」页面内按需下载(支持 ModelScope / GitHub 等多源)。
在终端中执行以下命令后重新运行应用:
sudo xattr -dr com.apple.quarantine /Applications/SmartSub.app
在「引擎与模型」页面把加速模式切换为「仅 CPU」,或改用其它转写引擎;诊断面板会给出失败原因。
欢迎提交 Issue 和 Pull Request 改进这个项目。
git clone https://github.com/buxuku/SmartSub.git
cd SmartSub
yarn install
yarn dev
如原生依赖自动下载失败(网络受限等),可手动执行 yarn native:fetch 重试。
本项目由以下赞助商支持:
如果这个项目对你有帮助,欢迎点一个 star,或者请作者喝一杯咖啡(请备注你的 GitHub 账号)。使用中有任何问题,欢迎加入 QQ 交流群(群号:655348339)。
| 支付宝收款码 | 微信赞赏码 | QQ 交流群 |
|---|---|---|
![]() | ![]() | ![]() |
本项目采用 MIT 许可证,详情见 LICENSE 文件。
4,879 followers · starred Feb 2025
96 followers · starred Jul 2024
1 followers · starred Feb 2025
25 followers · starred Feb 2025
TypeScript
83.5%
JavaScript
15.0%
Python
1.1%