ysn-rfd/text-dataset-tiny-code-script-py-format
USED of tahamajs/medicine_ds_persian for .parquet file USED of Alijafarixcs2/persian-it-llama2-2k for .parquet file USED of Abirate/english_quotes for .jsonl file NEW FILES (05/12/2025) NEW FILES (12/26/2025) NEW FILES (02/15/2026)
31.7k
1import torch
2from transformers import GPT2LMHeadModel, GPT2Tokenizer
3
4# بارگذاری مدل GPT-2 و توکنایزر
5model_name = "gpt2" # میتوانید از نسخههای دیگر مانند 'gpt2-medium' یا 'gpt2-large' استفاده کنید
6model = GPT2LMHeadModel.from_pretrained(model_name)
7tokenizer = GPT2Tokenizer.from_pretrained(model_name)
8
9# تابعی برای گفتوگو با مدل
10def chat_with_gpt2(input_text):
11 # تبدیل متن ورودی به توکنها
12 inputs = tokenizer.encode(input_text + tokenizer.eos_token, return_tensors='pt')
13
14 # استفاده از مدل برای تولید پاسخ
15 with torch.no_grad():
16 outputs = model.generate(inputs, max_length=150, num_return_sequences=1, no_repeat_ngram_size=2, pad_token_id=tokenizer.eos_token_id)
17
18 # تبدیل توکنها به متن
19 response = tokenizer.decode(outputs[0], skip_special_tokens=True)
20
21 return response
22
23# شروع گفتوگو
24print("سلام! از من سوال بپرسید.")
25while True:
26 user_input = input("شما: ")
27 if user_input.lower() == "خروج":
28 print("خداحافظ!")
29 break
30 response = chat_with_gpt2(user_input)
31 print("GPT-2: " + response)
32 