multi-document
code_trans_t5_base_code_documentation_generation_java_multitask_finetunecode_trans_t5_large_code_documentation_generation_javascript_multitask_finetunecode_trans_t5_base_code_documentation_generation_java_multitaskcode_trans_t5_base_code_documentation_generation_javascript_multitask_finetunecode_trans_t5_small_code_documentation_generation_javascript_multitask_finetunecode_trans_t5_base_code_documentation_generation_javascript_multitaskcode_trans_t5_base_code_documentation_generation_python_multitaskcode_trans_t5_small_code_documentation_generation_javascript_multitask
multi-domain-document-classification
multi_domain_document_classification
Multi-domain document classification datasets.
Biomedical: chemprot, rct-sample
Computer Science: citation_intent, sciie
Customer Review: amcd, yelp_review
Social Media: tweet_eval_irony, tweet_eval_hate, tweet_eval_emotion
The yelp_review dataset is randomly downsampled to 2000/2000/8000 for test/validation/train.
chemprot
citation_intent
hyperpartisan_news
rct_sample
sciie
amcd
yelp_review
tweet_eval_irony
tweet_eval_hate… See the full description on the dataset page: https://huggingface.co/datasets/asahi417/multi-domain-document-classification.multi_document_summarizationMulti-Document, a large-scale multi-document summarization dataset created from scientific articles. Multi-Document introduces a challenging multi-document summarization task: writing the related-work section of a paper based on its abstract and the articles it references.klue-mrc-gpt4o-generate-multi-document-answerklue-mrc-multi-document-answerklue-mrc-multi-document-answerFinance-Law-multi-document-answer
