datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
nor_agriculture_multi_hop_questions_bench
Nor Agriculture Multi Hop Questions Bench
This work is related to the project in adapting LLM to answer questions about Norwegian Agriculture in Norwegian.
The dataset was generated using YourBench (v0.9.0), an open-source framework for generating domain-specific benchmarks from document collections.
It needs further cleaning, verification in regards to citations and validation for diversity and topics coverage.
Also, it can play a role as a prove of concept for generating a… See the full description on the dataset page: https://huggingface.co/datasets/norjordAI/nor_agriculture_multi_hop_questions_bench.electronic-commerce-law-questions-multi-turns-v2eli5_question_answer_1107
Dataset Card for "eli5_question_answer_1107"
More Information needed
electronic-commerce-law-questions-multi-turns-v1flan_source_race_middle_Write_a_multi_choice_question_for_the_following_article_115multi-model-judge-comparison-question-viewflan_source_race_high_Write_a_multi_choice_question_for_the_following_article_72flan_source_race_high_Write_a_multi_choice_question_options_given__67MULTI_VALUE_mnli_inverted_indirect_question
Dataset Card for "MULTI_VALUE_mnli_inverted_indirect_question"
More Information needed
multi_expert_questionsMMLongBench_image_question_only_deepeyes_multi_viz_2_1120_newMULTI_VALUE_qqp_inverted_indirect_question
Dataset Card for "MULTI_VALUE_qqp_inverted_indirect_question"
More Information needed
flan_source_race_middle_Write_a_multi_choice_question_options_given__116MULTI_VALUE_cola_inverted_indirect_question
Dataset Card for "MULTI_VALUE_cola_inverted_indirect_question"
More Information needed
MULTI_VALUE_rte_inverted_indirect_question
Dataset Card for "MULTI_VALUE_rte_inverted_indirect_question"
More Information needed
MULTI_VALUE_mrpc_inverted_indirect_question
Dataset Card for "MULTI_VALUE_mrpc_inverted_indirect_question"
More Information needed
MMLongBench_image_question_only_deepeyes_multi_viz_2MMLongBench_image_question_only_deepeyes_multi_seed5
MMLongBench – 2025-12-12 09:08 UTC
Average accuracy: 39.35% (1052 samples with scores)
Subset metrics by evidence source:
Figure: samples=296, accuracy=35.14%
Pure-text (Plain-text): samples=296, accuracy=44.26%
Table: samples=217, accuracy=41.94%
Chart: samples=173, accuracy=38.73%
Generalized-text (Layout): samples=117, accuracy=27.35%
Subset metrics by evidence pages length:
no_pages: samples=214, accuracy=27.57%
single_page: samples=485, accuracy=53.20%
multiple_pages:… See the full description on the dataset page: https://huggingface.co/datasets/happy8825/MMLongBench_image_question_only_deepeyes_multi_seed5.MULTI_VALUE_wnli_inverted_indirect_question
Dataset Card for "MULTI_VALUE_wnli_inverted_indirect_question"
More Information needed
MULTI_VALUE_sst2_inverted_indirect_question
Dataset Card for "MULTI_VALUE_sst2_inverted_indirect_question"
More Information needed
MULTI_VALUE_stsb_inverted_indirect_question
Dataset Card for "MULTI_VALUE_stsb_inverted_indirect_question"
More Information needed
