vnahata/IndicDiarBench-speaker-retrieval
Indic DiarBench speaker retrieval (MTEB) Indic DiarBench reshaped for speaker retrieval across the 22 scheduled languages of India: given a clip of one speaker, find other clips of that same speaker. Source: sarvamai/indic-diarbench at revision 92877ba, cc-by-4.0, official test split. Turns are cut by their annotated times, restricted to 2 to 15 seconds, and turns overlapping a different speaker are dropped. identity pairs the recording session with the speaker, because speaker… See the full description on the dataset page: https://huggingface.co/datasets/vnahata/IndicDiarBench-speaker-retrieval.
01.2k
asm_corpus.parquetdownload
asm_queries.parquetdownload
ben_corpus.parquetdownload
ben_queries.parquetdownload
brx_corpus.parquetdownload
brx_queries.parquetdownload
doi_corpus.parquetdownload
doi_queries.parquetdownload
guj_corpus.parquetdownload
guj_queries.parquetdownload
hin_corpus.parquetdownload
hin_queries.parquetdownload
kan_corpus.parquetdownload
kan_queries.parquetdownload
kas_corpus.parquetdownload
kas_queries.parquetdownload
kok_corpus.parquetdownload
kok_queries.parquetdownload
mal_corpus.parquetdownload
mal_queries.parquetdownload
mar_corpus.parquetdownload
mar_queries.parquetdownload
mni_corpus.parquetdownload
mni_queries.parquetdownload
npi_corpus.parquetdownload
npi_queries.parquetdownload
ory_corpus.parquetdownload
ory_queries.parquetdownload
pan_corpus.parquetdownload
pan_queries.parquetdownload
san_corpus.parquetdownload
san_queries.parquetdownload
sat_corpus.parquetdownload
sat_queries.parquetdownload
tam_corpus.parquetdownload
tam_queries.parquetdownload
tel_corpus.parquetdownload
tel_queries.parquetdownload
urd_corpus.parquetdownload
urd_queries.parquetdownload
