LazarusNLP/indobert-lite-base-p1-indonli-multilingual-nli-distil-mdeberta
145
IndoBERT Lite Base IndoNLI Multilingual NLI Distil mDeBERTa
IndoBERT Lite Base IndoNLI Multilingual NLI Distil mDeBERTa is a natural language inference (NLI) model based on the ALBERT model. The model was originally the pre-trained indobenchmark/indobert-lite-base-p1 model, which is then fine-tuned on `IndoNLI` and the Indonesian subsets of MoritzLaurer/multilingual-NLI-26lang-2mil7, whilst being distilled from MoritzLaurer/mDeBERTa-v3-base-xnli-multilingual-nli-2mil7.
Evaluation Results
Model
Training procedure
Training hyperparameters
The following hyperparameters were used during training:
learning_rate:2e-05train_batch_size:64eval_batch_size:64seed:42optimizer: Adam withbetas=(0.9,0.999)andepsilon=1e-08lr_scheduler_type: linearnum_epochs:5
Training results
Framework versions
- Transformers 4.36.2
- Pytorch 2.1.2+cu121
- Datasets 2.16.1
- Tokenizers 0.15.0
References
[1] Mahendra, R., Aji, A. F., Louvan, S., Rahman, F., & Vania, C. (2021, November). IndoNLI: A Natural Language Inference Dataset for Indonesian. Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing. Association for Computational Linguistics.
