hotchpotch/NanoBEIR-es-with-bm25
๐ง This dataset is currently under construction. Specifications may change. NanoBEIR-es (with bm25 subset) A BM25-first retrieval subset derived from lightonai/NanoBEIR-es for reproducible NanoBEIR evaluation. What this dataset is Language: es BM25 top-k: 100 Number of evaluation splits: 13 This folder contains generated BM25 retrieval results and reproducibility metadata. Data structure corpus: _id, text queries: _id, text qrels: query-idโฆ See the full description on the dataset page: https://huggingface.co/datasets/hotchpotch/NanoBEIR-es-with-bm25.
๐ง This dataset is currently under construction. Specifications may change.
NanoBEIR-es (with bm25 subset)
A BM25-first retrieval subset derived from lightonai/NanoBEIR-es for reproducible NanoBEIR evaluation.
What this dataset is
- Language:
es - BM25 top-k:
100 - Number of evaluation splits:
13 - This folder contains generated BM25 retrieval results and reproducibility metadata.
Data structure
corpus:_id,textqueries:_id,textqrels:query-id,corpus-id,scorebm25:query-id,corpus-ids(A bm25 subset is included for first-stage retrieval and reranking experiments.)
BM25 baseline scores
Selected BM25 algorithm
Subset names
- Split names:
NanoArguAna,NanoClimateFEVER,NanoDBPedia,NanoFEVER,NanoFiQA2018,NanoHotpotQA,NanoMSMARCO,NanoNFCorpus,NanoNQ,NanoQuoraRetrieval,NanoSCIDOCS,NanoSciFact,NanoTouche2020 - Config names in this output folder:
bm25
BM25 split-level baseline (nDCG)
Upstream source
- Original dataset: lightonai/NanoBEIR-es
License
Same as the upstream dataset. Follow upstream licensing and attribution requirements.
