datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
parakeet-tdt-blind-spots
Blind Spots of nvidia/parakeet-tdt-0.6b-v2
This dataset documents 14 systematically identified blind spots in NVIDIA's parakeet-tdt-0.6b-v2 automatic speech recognition model. The errors span 8 distinct categories and reveal a consistent pattern: the model struggles with inputs outside the distribution of its Western English-centric training data.
Model Under Test
Property
Value
Model
nvidia/parakeet-tdt-0.6b-v2
Parameters
600M
Architecture… See the full description on the dataset page: https://huggingface.co/datasets/TieIncred/parakeet-tdt-blind-spots.eval-parakeet-tdt-0.6b-v3-eka-hard-20260408-1920
Evaluation Results: parakeet-tdt-0.6b-v3
Evaluation results from Whisper model evaluation.
Summary
Model
WER
CER
nvidia/parakeet-tdt-0.6b-v3
37.59%
20.64%
Source Data
Evaluation Dataset: Trelis/eka-hard
Model Evaluated: nvidia/parakeet-tdt-0.6b-v3
Columns
Column
Description
audio
Audio sample (if available from source dataset)
reference
Ground truth transcription
prediction
Model prediction
wer
Word Error Rate for… See the full description on the dataset page: https://huggingface.co/datasets/Trelis/eval-parakeet-tdt-0.6b-v3-eka-hard-20260408-1920.eval-parakeet-tdt-0.6b-v3-medical-terms-2025-20260408-1926
Evaluation Results: parakeet-tdt-0.6b-v3
Evaluation results from Whisper model evaluation.
Summary
Model
WER
CER
nvidia/parakeet-tdt-0.6b-v3
11.34%
3.63%
Source Data
Evaluation Dataset: Trelis/medical-terms-2025
Model Evaluated: nvidia/parakeet-tdt-0.6b-v3
Columns
Column
Description
audio
Audio sample (if available from source dataset)
reference
Ground truth transcription
prediction
Model prediction
wer
Word Error… See the full description on the dataset page: https://huggingface.co/datasets/Trelis/eval-parakeet-tdt-0.6b-v3-medical-terms-2025-20260408-1926.eval-parakeet-tdt-0.6b-v3-multimed-hard-20260408-1930
Evaluation Results: parakeet-tdt-0.6b-v3
Evaluation results from Whisper model evaluation.
Summary
Model
WER
CER
nvidia/parakeet-tdt-0.6b-v3
15.94%
10.13%
Source Data
Evaluation Dataset: Trelis/multimed-hard
Model Evaluated: nvidia/parakeet-tdt-0.6b-v3
Columns
Column
Description
audio
Audio sample (if available from source dataset)
reference
Ground truth transcription
prediction
Model prediction
wer
Word Error Rate… See the full description on the dataset page: https://huggingface.co/datasets/Trelis/eval-parakeet-tdt-0.6b-v3-multimed-hard-20260408-1930.
