mteb/MIRACLRetrieval
MIRACLRetrieval An MTEB dataset Massive Text Embedding Benchmark MIRACL (Multilingual Information Retrieval Across a Continuum of Languages) is a multilingual retrieval dataset that focuses on search across 18 different languages. Task category t2t Domains Encyclopaedic, Written Reference http://miracl.ai/ How to evaluate on this task You can evaluate an embedding model on this dataset using the following code: import mteb task =… See the full description on the dataset page: https://huggingface.co/datasets/mteb/MIRACLRetrieval.
92.9k
../
dev-00000-of-00012.parquetdownload
dev-00001-of-00012.parquetdownload
dev-00002-of-00012.parquetdownload
dev-00003-of-00012.parquetdownload
dev-00004-of-00012.parquetdownload
dev-00005-of-00012.parquetdownload
dev-00006-of-00012.parquetdownload
dev-00007-of-00012.parquetdownload
dev-00008-of-00012.parquetdownload
dev-00009-of-00012.parquetdownload
dev-00010-of-00012.parquetdownload
dev-00011-of-00012.parquetdownload
