ysn-rfd/text-dataset-tiny-code-script-py-format
USED of tahamajs/medicine_ds_persian for .parquet file USED of Alijafarixcs2/persian-it-llama2-2k for .parquet file USED of Abirate/english_quotes for .jsonl file NEW FILES (05/12/2025) NEW FILES (12/26/2025) NEW FILES (02/15/2026)
31.6k
1from transformers import AutoModelForCausalLM, AutoTokenizer, GenerationConfig
2
3model = AutoModelForCausalLM.from_pretrained('roneneldan/TinyStories-33M')
4tokenizer = AutoTokenizer.from_pretrained("EleutherAI/gpt-neo-125M")
5prompt = "my name is yasin"
6input_ids = tokenizer.encode(prompt, return_tensors="pt")
7
8# Generate completion
9output = model.generate(input_ids, max_length = 64, num_beams=10)
10
11# Decode the completion
12output_text = tokenizer.decode(output[0], skip_special_tokens=True)
13
14# Print the generated text
15print(output_text)
16 