datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
triviaqa_speech
TriviaQA Speech
Speech version of TriviaQA eval, where the speech is synthesized using XTTS-v2. Note that there might not be a 1:1 mapping with the original text eval due to TTS failures.
trivia_qa-audiotrivia_qa-audiotrivia_qa-audio-scoretrivia_qa-audio-texttrivia_qa-audio-text_originaltrivia_qa-audio-text_original-scoretrivia_qa-audio-text-scoretrivia_qa-audio-ASR_GT-scoretrivia_qa-audio-ASR_GT
