KasuleTrevor/cdli-qwen3-asr-lg-typical-textpre-0p6b-v2-lr1e4
011
CDLI Qwen3-ASR Luganda Typical Speech Fine-tune
This repo contains the selected checkpoint checkpoint-24500 from the LG-QWEN3-ASR-TYPICAL-TEXTPRE-0P6B-V2-LR1E4 run.
Training Setup
- Base model: KasuleTrevor/cdli-qwen3-asr-lg-textpre-0p6b-v2
- Datasets: KasuleTrevor/lg_100hrs + dmusingu/yogera-dataset (Luganda split)
- Training language tag:
Luganda - Forced inference language: disabled
- Epochs: 6
- Batch size: 8
- Gradient accumulation: 2
- Learning rate: 0.0001
- Scheduler: cosine
- Warmup ratio: 0.03
- Save steps: 500
- Selected checkpoint: checkpoint-24500
- Selection reason: best validation normalized WER (0.190353, CER 0.047268)
Final Test Metrics
- Corpus WER (normalized): 0.249439
- Corpus CER (normalized): 0.077364
- Average utterance WER (normalized): 0.250726
- Average utterance CER (normalized): 0.076617
Checkpoint Selection Evidence
Source Dataset Breakdown
Artifacts
- Result folder:
results/checkpoint-24500/ - Includes checkpoint validation summaries, final test predictions, scored outputs, and grouped analyses.
