CoolFace
Datasetpublic

hakari-bench/NanoR2MED

NanoR2MED This dataset is a Nano-style retrieval dataset for HAKARI-bench. NanoR2MED contains 8 Nano retrieval splits derived from R2MED. Each split keeps up to 200 eligible queries and up to 10000 corpus documents, with exact duplicate query and document text removed where the generator records that policy. Usage from datasets import load_dataset dataset_id = "hakari-bench/NanoR2MED" split = "NanoR2MEDBioinformatics" queries = load_dataset(dataset_id, "queries"… See the full description on the dataset page: https://huggingface.co/datasets/hakari-bench/NanoR2MED.

sourceHugging Faceupdated 4mo agoView on Hugging Face
0likes318downloads
11 commits on main
4f46f9e4mo ago

Update dataset README for reranking_hybrid candidates

hotchpotch
d3f2a9f4mo ago

Update dataset README for reranking_hybrid candidates

hotchpotch
90e18804mo ago

Add reranking_hybrid metadata

hotchpotch
0f245564mo ago

Update reranking_hybrid for reranking_hybrid candidates

hotchpotch
963b9414mo ago

Update harrier_oss_v1_270m for reranking_hybrid candidates

hotchpotch
fd748e74mo ago

Update bm25 for reranking_hybrid candidates

hotchpotch
ac0d3614mo ago

Update qrels for reranking_hybrid candidates

hotchpotch
1fa5d6d4mo ago

Update queries for reranking_hybrid candidates

hotchpotch
2362eae4mo ago

Update corpus for reranking_hybrid candidates

hotchpotch
d4779805mo ago

Copy dataset from hotchpotch/NanoR2MED

hotchpotch
e4b2a565mo ago

initial commit

hotchpotch