RoxasYTB/cavejohnson_en-ljspeech
Cave Johnson — English (en) LJSpeech dataset of Cave Johnson (en). 234 pairs 44.1kHz mono 16-bit PCM WAV (original wiki quality) Piper TTS Training (High Quality on T4 GPU) Preprocessing (downsample to 22.05kHz) python3 -m piper_train.preprocess \ --language en-us \ --input-dir ./cavejohnson_en \ --output-dir ./train_cavejohnson_en \ --dataset-format ljspeech \ --single-speaker \ --sample-rate 22050 Training (Kaggle T4… See the full description on the dataset page: https://huggingface.co/datasets/RoxasYTB/cavejohnson_en-ljspeech.
011
Cave Johnson — English (en)
LJSpeech dataset of Cave Johnson (en).
- 234 pairs
- 44.1kHz mono 16-bit PCM WAV (original wiki quality)
Piper TTS Training (High Quality on T4 GPU)
Preprocessing (downsample to 22.05kHz)
python3 -m piper_train.preprocess \
--language en-us \
--input-dir ./cavejohnson_en \
--output-dir ./train_cavejohnson_en \
--dataset-format ljspeech \
--single-speaker \
--sample-rate 22050Training (Kaggle T4 16GB)
python3 -m piper_train \
--dataset-dir ./train_cavejohnson_en \
--accelerator 'gpu' \
--devices 1 \
--quality high \
--batch-size 16 \
--validation-split 0.0 \
--num-test-examples 0 \
--max_epochs 10000 \
--resume_from_checkpoint /path/to/checkpoint.ckpt \
--checkpoint-epochs 1 \
--precision 32 \
--max-phoneme-ids 400