datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
long-doc_book_enAvailable Versions:
AIR-Bench_24.04
Task / Domain / Language: long-doc / book / en
Available Datasets (Dataset Name: Splits):
origin-of-species_darwin: test
a-brief-history-of-time_stephen-hawking: test
AIR-Bench_24.05
Task / Domain / Language: long-doc / book / en
Available Datasets (Dataset Name: Splits):
origin-of-species_darwin: test
a-brief-history-of-time_stephen-hawking: dev
long-doc_law_enAvailable Versions:
AIR-Bench_24.04
Task / Domain / Language: long-doc / law / en
Available Datasets (Dataset Name: Splits):
lex_files_300K-400K: test
lex_files_400K-500K: test
lex_files_500K-600K: test
lex_files_600K-700K: test
AIR-Bench_24.05
Task / Domain / Language: long-doc / law / en
Available Datasets (Dataset Name: Splits):
lex_files_300K-400K: dev
lex_files_400K-500K: test
lex_files_500K-600K: test
lex_files_600K-700K: test
long-doc_arxiv_enAvailable Versions:
AIR-Bench_24.04
Task / Domain / Language: long-doc / arxiv / en
Available Datasets (Dataset Name: Splits):
gpt3: test
llama2: test
gemini: test
llm-survey: test
AIR-Bench_24.05
Task / Domain / Language: long-doc / arxiv / en
Available Datasets (Dataset Name: Splits):
gpt3: test
llama2: dev
gemini: test
llm-survey: test
long-doc_healthcare_enAvailable Versions:
AIR-Bench_24.04
Task / Domain / Language: long-doc / healthcare / en
Available Datasets (Dataset Name: Splits):
pubmed_100K-200K_1: test
pubmed_100K-200K_2: test
pubmed_100K-200K_3: test
pubmed_40K-50K_5-merged: test
pubmed_30K-40K_10-merged: test
AIR-Bench_24.05
Task / Domain / Language: long-doc / healthcare / en
Available Datasets (Dataset Name: Splits):
pubmed_100K-200K_1: test
pubmed_100K-200K_2: test
pubmed_100K-200K_3: dev
pubmed_40K-50K_5-merged: test… See the full description on the dataset page: https://huggingface.co/datasets/AIR-Bench/long-doc_healthcare_en.qrels-long-doc_book_en-devAvailable Versions:
AIR-Bench_24.04
Task / Domain / Language: long-doc / book / en
Available Datasets (Dataset Name: Splits):
origin-of-species_darwin: test
a-brief-history-of-time_stephen-hawking: test
AIR-Bench_24.05
Task / Domain / Language: long-doc / book / en
Available Datasets (Dataset Name: Splits):
origin-of-species_darwin: test
a-brief-history-of-time_stephen-hawking: dev
qrels-long-doc_arxiv_en-devAvailable Versions:
AIR-Bench_24.04
Task / Domain / Language: long-doc / arxiv / en
Available Datasets (Dataset Name: Splits):
gpt3: test
llama2: test
gemini: test
llm-survey: test
AIR-Bench_24.05
Task / Domain / Language: long-doc / arxiv / en
Available Datasets (Dataset Name: Splits):
gpt3: test
llama2: dev
gemini: test
llm-survey: test
qrels-long-doc_law_en-devAvailable Versions:
AIR-Bench_24.04
Task / Domain / Language: long-doc / law / en
Available Datasets (Dataset Name: Splits):
lex_files_300K-400K: test
lex_files_400K-500K: test
lex_files_500K-600K: test
lex_files_600K-700K: test
AIR-Bench_24.05
Task / Domain / Language: long-doc / law / en
Available Datasets (Dataset Name: Splits):
lex_files_300K-400K: dev
lex_files_400K-500K: test
lex_files_500K-600K: test
lex_files_600K-700K: test
qrels-long-doc_healthcare_en-devAvailable Versions:
AIR-Bench_24.04
Task / Domain / Language: long-doc / healthcare / en
Available Datasets (Dataset Name: Splits):
pubmed_100K-200K_1: test
pubmed_100K-200K_2: test
pubmed_100K-200K_3: test
pubmed_40K-50K_5-merged: test
pubmed_30K-40K_10-merged: test
AIR-Bench_24.05
Task / Domain / Language: long-doc / healthcare / en
Available Datasets (Dataset Name: Splits):
pubmed_100K-200K_1: test
pubmed_100K-200K_2: test
pubmed_100K-200K_3: dev
pubmed_40K-50K_5-merged: test… See the full description on the dataset page: https://huggingface.co/datasets/AIR-Bench/qrels-long-doc_healthcare_en-dev.FedE4OODRAG4FINFedE4LEGFedE4FIN
