一个功能强大的Windows桌面录音转写软件,集成了多种先进的语音识别引擎,支持实时录音、音频文件转写和智能音频源管理。
recording_YYYYMMDD_HHMMSS.wavGoogle Speech Recognition (在线)
OpenAI Whisper (离线)
BELLE-2/Belle-whisper-large-v3-turbo-zh (离线)
# 克隆项目
git clone <repository-url>
cd reco-tran
# 安装Python依赖
pip install -r requirements.txt
# 如果PyAudio安装失败,使用以下方法:
pip install pipwin
pipwin install pyaudio
python audio_transcriber.py
设备配置
开始录音
停止录音
在 audio_transcriber.py 中可以调整以下参数:
self.rate = 16000 # 采样率(推荐16kHz)
self.channels = 1 # 声道数(单声道)
self.chunk = 1024 # 缓冲区大小
self.buffer_duration = 5 # 实时转写缓冲时长(秒)
症状: 无法检测到音频设备或录音无声 解决方案:
症状: Whisper/BELLE模型下载失败 解决方案:
症状: "系统找不到指定的文件"错误 解决方案:
# 方法1:安装imageio-ffmpeg(推荐)
pip install imageio-ffmpeg
# 方法2:手动安装ffmpeg
# 1. 下载ffmpeg: https://ffmpeg.org/download.html
# 2. 解压到C:\ffmpeg
# 3. 添加C:\ffmpeg\bin到系统PATH
# 4. 重启程序
# 验证安装
ffmpeg -version
症状: 模型运行缓慢,未使用GPU 解决方案:
pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118
优化建议:
| 模型 | 中文准确率 | 处理速度 | 内存占用 | 离线支持 |
|---|---|---|---|---|
| 95% | 快 | 低 | ❌ | |
| BELLE | 97% | 中等 | 高 | ✅ |
| Whisper-turbo | 92% | 快 | 中等 | ✅ |
| Whisper-small | 88% | 中等 | 低 | ✅ |
| 使用场景 | CPU | 内存 | GPU | 推荐配置 |
|---|---|---|---|---|
| 基础使用 | 双核2GHz+ | 4GB | 无 | Google引擎 |
| 离线转写 | 四核3GHz+ | 8GB | 无 | Whisper-small |
| 高性能转写 | 八核3GHz+ | 16GB | GTX1060+ | BELLE模型 |
git checkout -b feature/AmazingFeature)git commit -m 'Add some AmazingFeature')git push origin feature/AmazingFeature)本项目采用MIT许可证 - 查看 LICENSE 文件了解详情
本软件仅供学习和个人使用。使用本软件进行录音时,请遵守当地法律法规,尊重他人隐私权。开发者不承担因使用本软件而产生的任何法律责任。
如果这个项目对您有帮助,请给个⭐️支持一下!
49 commits
Python
100.0%
一个功能强大的Windows桌面录音转写软件,集成了多种先进的语音识别引擎,支持实时录音、音频文件转写和智能音频源管理。
recording_YYYYMMDD_HHMMSS.wavGoogle Speech Recognition (在线)
OpenAI Whisper (离线)
BELLE-2/Belle-whisper-large-v3-turbo-zh (离线)
# 克隆项目
git clone <repository-url>
cd reco-tran
# 安装Python依赖
pip install -r requirements.txt
# 如果PyAudio安装失败,使用以下方法:
pip install pipwin
pipwin install pyaudio
python audio_transcriber.py
设备配置
开始录音
停止录音
在 audio_transcriber.py 中可以调整以下参数:
self.rate = 16000 # 采样率(推荐16kHz)
self.channels = 1 # 声道数(单声道)
self.chunk = 1024 # 缓冲区大小
self.buffer_duration = 5 # 实时转写缓冲时长(秒)
症状: 无法检测到音频设备或录音无声 解决方案:
症状: Whisper/BELLE模型下载失败 解决方案:
症状: "系统找不到指定的文件"错误 解决方案:
# 方法1:安装imageio-ffmpeg(推荐)
pip install imageio-ffmpeg
# 方法2:手动安装ffmpeg
# 1. 下载ffmpeg: https://ffmpeg.org/download.html
# 2. 解压到C:\ffmpeg
# 3. 添加C:\ffmpeg\bin到系统PATH
# 4. 重启程序
# 验证安装
ffmpeg -version
症状: 模型运行缓慢,未使用GPU 解决方案:
pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118
优化建议:
| 模型 | 中文准确率 | 处理速度 | 内存占用 | 离线支持 |
|---|---|---|---|---|
| 95% | 快 | 低 | ❌ | |
| BELLE | 97% | 中等 | 高 | ✅ |
| Whisper-turbo | 92% | 快 | 中等 | ✅ |
| Whisper-small | 88% | 中等 | 低 | ✅ |
| 使用场景 | CPU | 内存 | GPU | 推荐配置 |
|---|---|---|---|---|
| 基础使用 | 双核2GHz+ | 4GB | 无 | Google引擎 |
| 离线转写 | 四核3GHz+ | 8GB | 无 | Whisper-small |
| 高性能转写 | 八核3GHz+ | 16GB | GTX1060+ | BELLE模型 |
git checkout -b feature/AmazingFeature)git commit -m 'Add some AmazingFeature')git push origin feature/AmazingFeature)本项目采用MIT许可证 - 查看 LICENSE 文件了解详情
本软件仅供学习和个人使用。使用本软件进行录音时,请遵守当地法律法规,尊重他人隐私权。开发者不承担因使用本软件而产生的任何法律责任。
如果这个项目对您有帮助,请给个⭐️支持一下!
49 commits
Python
100.0%