CoolFace
Modelpublic

minhtoan/gpt2-vietnamese

sourceHugging Faceupdated 4y agoView on Hugging Face
1likes50downloads
Model Card

GPT-2

GPT-2, a language pretrained model with a causal language modeling (CLM) goal, is a transformer-based language model. This model was pre-trained and used to generate text on the Vietnamese Wikilingua dataset.

How to use the model

~~~~ from transformers import GPT2Tokenizer, GPT2LMHeadModel

tokenizer = GPT2Tokenizer.frompretrained('minhtoan/vietnamese-gpt2-finetune') model = GPT2LMHeadModel.frompretrained('minhtoan/vietnamese-gpt2-finetune')

text = "Không phải tất cả các nguyên liệu lành mạnh đều đắt đỏ." inputids = tokenizer.encode(text, returntensors='pt') max_length = 100

sampleoutputs = model.generate(inputids,padtokenid=tokenizer.eostokenid, dosample=True, maxlength=maxlength, minlength=maxlength, numreturn_sequences=3)

for i, sampleoutput in enumerate(sampleoutputs): print(">> Generated text {}\n\n{}".format(i+1, tokenizer.decode(sample_output.tolist()))) print('\n---') ~~~~

Author

Phan Minh Toan