hakari-bench/NanoDAPFAM
NanoDAPFAM This dataset is a Nano-style retrieval dataset for HAKARI-bench. NanoDAPFAM contains 18 Nano retrieval splits derived from DAPFAM. Each split keeps up to 200 eligible queries and up to 10000 corpus documents, with exact duplicate query and document text removed where the generator records that policy. Usage from datasets import load_dataset dataset_id = "hakari-bench/NanoDAPFAM" split = "NanoDAPFAMAllTitlAbsClmToFullText" queries =… See the full description on the dataset page: https://huggingface.co/datasets/hakari-bench/NanoDAPFAM.
Update dataset README for reranking_hybrid candidates
Update dataset README for reranking_hybrid candidates
Update dataset README for reranking_hybrid candidates
Add reranking_hybrid metadata
Update reranking_hybrid for reranking_hybrid candidates
Update harrier_oss_v1_270m for reranking_hybrid candidates
Update bm25 for reranking_hybrid candidates
Update qrels for reranking_hybrid candidates
Update queries for reranking_hybrid candidates
Update corpus for reranking_hybrid candidates
Update dataset README
Upload split metadata
Upload nano_bm25_subset_config.json
Upload manifest.json
Upload bm25 config
Upload qrels config
Upload queries config
Upload corpus config
initial commit
