ILRDF/nllb-600m-formosan-all-finetune
017
Model Card for nllb-600m-formosan-all-finetune
Model Details
nllb-200-distilled-600M finetune on all formosan data (klokah, fb ilrdf dict, formosan_db) without samples only one word.
Training Details
- learning rate: 0.0001
- batch size per gpu: 4
- grad accumulation steps: 1
- epochs: 12
- warmup ratio: 0.1
Uses
please refer https://huggingface.co/docs/transformers/model_doc/nllb
