xkas2001/uzbek-language-dataset
Uzbek Language Dataset Collection Bu repository o'zbek tili uchun eng keng ko'lamli va keng qamrovli dataset to'plami hisoblanadi. Dataset turli manbalardan to'plangan va NLP modellari, til modellari va boshqa AI ilovalar uchun mo'ljallangan. 📊 Dataset Overview Bu dataset to'plami 4ta asosiy qism va qo'shimcha merge qilish asboblaridan iborat: 🎯 Dataset Qismlari Dataset Hajmi Maqsad Source community-oscar-uzbek 1.1GB OSCAR Community… See the full description on the dataset page: https://huggingface.co/datasets/xkas2001/uzbek-language-dataset.
Upload dataset_card.py with huggingface_hub
Upload community-oscar-uzbek/top5_metadata_text.txt with huggingface_hub
Upload folder using huggingface_hub
Upload community-oscar-uzbek/uzbek_words_unique_clean.txt with huggingface_hub
Upload community-oscar-uzbek/uzbek_words_frequency_community.txt with huggingface_hub
Upload folder using huggingface_hub
Upload merge/unique_words.txt with huggingface_hub
Upload merge/frequency_list.txt with huggingface_hub
Upload custom-uzbek/parsed_with_imlo_without_emoji.txt with huggingface_hub
Upload custom-uzbek/parsed_with_imlo.txt with huggingface_hub
Upload community-oscar-uzbek/all_metadata_text.txt with huggingface_hub
Upload README.md with huggingface_hub
initial commit
