CoolFace
Datasetpublic

tomas-gajarsky/speech-commands-lt

Speech Commands-LT (Long Tail) Long-tail variants of Google Speech Commands v0.02 for benchmarking imbalanced audio classification. Dataset Summary Speech Commands v0.02 (Warden, 2018) contains 35 spoken word classes with ~1,200-3,200 samples each. This dataset applies exponential decay to the training set to create long-tail distributions with varying imbalance ratios, simulating real-world class imbalance in audio classification. The _silence_ class (label 35)… See the full description on the dataset page: https://huggingface.co/datasets/tomas-gajarsky/speech-commands-lt.

sourceHugging Facecc-by-4.0updated 6mo agoView on Hugging Face
0likes142downloads
6 commits on main
1cbcc6a6mo ago

Add dataset card

tomas-gajarsky
a7ed1f46mo ago

Upload dataset

tomas-gajarsky
edfa46a6mo ago

Upload dataset

tomas-gajarsky
ac9ab796mo ago

Upload dataset

tomas-gajarsky
52a9f2a6mo ago

Upload dataset

tomas-gajarsky
2a2c0c06mo ago

initial commit

tomas-gajarsky