CoolFace
Modelpublic

LazarusNLP/indobert-lite-base-p1-indonli-multilingual-nli-distil-mdeberta

sourceHugging Facemitupdated 3y agoView on Hugging Face
1likes45downloads
Model Card

IndoBERT Lite Base IndoNLI Multilingual NLI Distil mDeBERTa

IndoBERT Lite Base IndoNLI Multilingual NLI Distil mDeBERTa is a natural language inference (NLI) model based on the ALBERT model. The model was originally the pre-trained indobenchmark/indobert-lite-base-p1 model, which is then fine-tuned on `IndoNLI` and the Indonesian subsets of MoritzLaurer/multilingual-NLI-26lang-2mil7, whilst being distilled from MoritzLaurer/mDeBERTa-v3-base-xnli-multilingual-nli-2mil7.

Evaluation Results

`dev` Acc.`test_lay` Acc.`test_expert` Acc.
IndoNLI78.6074.6965.55

Model

Model#paramsArch.Training/Validation data (text)
indobert-lite-base-p1-indonli-multilingual-nli-distil-mdeberta11.7MALBERT BaseIndoNLI, Multilingual NLI (id)

Training procedure

Training hyperparameters

The following hyperparameters were used during training:

  • —learning_rate: 2e-05
  • —train_batch_size: 64
  • —eval_batch_size: 64
  • —seed: 42
  • —optimizer: Adam with betas=(0.9,0.999) and epsilon=1e-08
  • —lr_scheduler_type: linear
  • —num_epochs: 5

Training results

Training LossEpochStepValidation LossAccuracyF1PrecisionRecall
0.48081.018030.44180.76830.75930.79040.7554
0.45292.036060.43430.77380.76480.78930.7619
0.42633.054090.43830.78610.78280.78740.7807
0.3984.072120.44560.77920.77670.77920.7756
0.37725.090150.44990.77110.76740.77000.7661

Framework versions

  • —Transformers 4.36.2
  • —Pytorch 2.1.2+cu121
  • —Datasets 2.16.1
  • —Tokenizers 0.15.0

References

[1] Mahendra, R., Aji, A. F., Louvan, S., Rahman, F., & Vania, C. (2021, November). IndoNLI: A Natural Language Inference Dataset for Indonesian. Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing. Association for Computational Linguistics.