minhtoan/gpt2-vietnamese
GPT-2
GPT-2, a language pretrained model with a causal language modeling (CLM) goal, is a transformer-based language model. This model was pre-trained and used to generate text on the Vietnamese Wikilingua dataset.
How to use the model
~~~~ from transformers import GPT2Tokenizer, GPT2LMHeadModel
tokenizer = GPT2Tokenizer.frompretrained('minhtoan/vietnamese-gpt2-finetune') model = GPT2LMHeadModel.frompretrained('minhtoan/vietnamese-gpt2-finetune')
text = "Không phải tất cả các nguyên liệu lành mạnh đều đắt đỏ." inputids = tokenizer.encode(text, returntensors='pt') max_length = 100
sampleoutputs = model.generate(inputids,padtokenid=tokenizer.eostokenid, dosample=True, maxlength=maxlength, minlength=maxlength, numreturn_sequences=3)
for i, sampleoutput in enumerate(sampleoutputs): print(">> Generated text {}\n\n{}".format(i+1, tokenizer.decode(sample_output.tolist()))) print('\n---') ~~~~
Author
Phan Minh Toan
