日本語の音声・動画を高精度に文字起こしする CLI / GUI ツール(話者分離つき)。
.txt / .speakers.txt(話者ラベル付き)/ .srt(字幕)Python 3.11 / Windows。別途 ffmpeg が PATH に必要。
git clone https://github.com/tomo-06-15/kotoba-transcribe.git
cd kotoba-transcribe
py -3.11 -m venv .venv
.venv\Scripts\python.exe -m pip install -r requirements.txt --index-url https://download.pytorch.org/whl/cpu
⚠️ torch/torchaudio は CPU版固定(上げると pyannote が壊れる)。理由と注意は 引継ぎ資料.md セクション3・4を必読。
transcribe_gui.bat をダブルクリック → 「追加...」でファイルを選択(複数可)→ 「文字起こし開始」。
.venv\Scripts\python.exe transcribe.py 会議.m4a
.venv\Scripts\python.exe transcribe.py a.m4a b.m4a c.m4a # 複数(キュー処理)
主なオプション: --engine kotoba|faster / --num-speakers N / --device cpu|igpu / --output-dir DIR
Intel Arc iGPU を使う場合は別venv .venv-ov と OpenVINO モデルの用意が必要です。手順は 引継ぎ資料.md セクション11を参照。
セットアップの詳細・依存を固定する理由・speechbrainパッチなどの要点は 引継ぎ資料.md にまとまっています。
1 commits
Python
99.4%
日本語の音声・動画を高精度に文字起こしする CLI / GUI ツール(話者分離つき)。
.txt / .speakers.txt(話者ラベル付き)/ .srt(字幕)Python 3.11 / Windows。別途 ffmpeg が PATH に必要。
git clone https://github.com/tomo-06-15/kotoba-transcribe.git
cd kotoba-transcribe
py -3.11 -m venv .venv
.venv\Scripts\python.exe -m pip install -r requirements.txt --index-url https://download.pytorch.org/whl/cpu
⚠️ torch/torchaudio は CPU版固定(上げると pyannote が壊れる)。理由と注意は 引継ぎ資料.md セクション3・4を必読。
transcribe_gui.bat をダブルクリック → 「追加...」でファイルを選択(複数可)→ 「文字起こし開始」。
.venv\Scripts\python.exe transcribe.py 会議.m4a
.venv\Scripts\python.exe transcribe.py a.m4a b.m4a c.m4a # 複数(キュー処理)
主なオプション: --engine kotoba|faster / --num-speakers N / --device cpu|igpu / --output-dir DIR
Intel Arc iGPU を使う場合は別venv .venv-ov と OpenVINO モデルの用意が必要です。手順は 引継ぎ資料.md セクション11を参照。
セットアップの詳細・依存を固定する理由・speechbrainパッチなどの要点は 引継ぎ資料.md にまとまっています。
1 commits
Python
99.4%