low-resource
omnivoice-amhariclow-resource-data-quality-classification-demo-catNLP-for-Low-Resource-Languagesexplainable-xlmr-code-mixed-low-resource-langbart-base-samsumgen-low-resource-percent10-xsum-conv-cl-seed42xlm-roberta-low-resource-langID-large2bart-base-samsumgen-low-resource-percent5-xsum-conv-seed42bart-base-samsumgen-low-resource-percent1-xsum-conv-cl-seed42
low_resource_languages_pretrain_data5low_resource_languages_pretrain_data2low_resource_languages_pretrain_data8low_resource_languages_pretrainLow-resource-QE-DA-dataset
Low-resource QE-DA Dataset
Direct Assessment (DA) quality estimation data for English→Indic (Gujarati, Hindi, Marathi, Tamil, Telugu) and related Estonian/Nepali/Sinhala pairs, released with the ALOPE work on LLM-based QE.
Paper: Sindhujan, A., Qian, S., Matthew, C.C.C., Orasan, C., and Kanojia, D. (2024). ALOPE: Adaptive Layer Optimization for Translation Quality Estimation using Large Language Models. In Second Conference on Language Modeling. (arXiv)
Task: Sentence-level quality… See the full description on the dataset page: https://huggingface.co/datasets/surrey-nlp/Low-resource-QE-DA-dataset.low_resource_languages_pretrain_data4
