ammarnasr/the-stack-rust-clean
Dataset 1: TheStack - Rust - Cleaned Description: This dataset is drawn from TheStack Corpus, an open-source code dataset with over 3TB of GitHub data covering 48 programming languages. We selected a small portion of this dataset to optimize smaller language models for Rust, a popular statically typed language. Target Language: Rust Dataset Size: Training: 900,000 files Validation: 50,000 files Test: 50,000 files Preprocessing: Selected Rust as the target language due to its… See the full description on the dataset page: https://huggingface.co/datasets/ammarnasr/the-stack-rust-clean.
Update README.md (#2)
Update README.md
Upload README.md with huggingface_hub
Upload data/valid-00001-of-00002-f3de108ae89a1eab.parquet with huggingface_hub
Upload data/valid-00000-of-00002-b267614807e7e8f4.parquet with huggingface_hub
Upload data/test-00001-of-00002-f541306943083be0.parquet with huggingface_hub
Upload data/test-00000-of-00002-8830410829123b8e.parquet with huggingface_hub
Upload data/train-00023-of-00024-083cf8d730668a19.parquet with huggingface_hub
Upload data/train-00022-of-00024-5df01f403630fea1.parquet with huggingface_hub
Upload data/train-00021-of-00024-c38e1b24c6726e5e.parquet with huggingface_hub
Upload data/train-00020-of-00024-44161d12774798b2.parquet with huggingface_hub
Upload data/train-00019-of-00024-75f3c4d39f333cea.parquet with huggingface_hub
Upload data/train-00018-of-00024-675270ec8eae015c.parquet with huggingface_hub
Upload data/train-00017-of-00024-c3f5f3f86f3d2a01.parquet with huggingface_hub
Upload data/train-00016-of-00024-652881cddc7e7b25.parquet with huggingface_hub
Upload data/train-00015-of-00024-d8328166a2a86ed0.parquet with huggingface_hub
Upload data/train-00014-of-00024-23c0387637e04a2c.parquet with huggingface_hub
Upload data/train-00013-of-00024-8156ce78ce483e3c.parquet with huggingface_hub
Upload data/train-00012-of-00024-d6c18b72186e7e98.parquet with huggingface_hub
Upload data/train-00011-of-00024-9451b08cb6092ba4.parquet with huggingface_hub
Upload data/train-00010-of-00024-768f1e1b3cf88d6f.parquet with huggingface_hub
Upload data/train-00009-of-00024-a1bf792eb2bda2d7.parquet with huggingface_hub
Upload data/train-00008-of-00024-f2b61b280c5e5281.parquet with huggingface_hub
Upload data/train-00007-of-00024-758c2761d1f4a69d.parquet with huggingface_hub
Upload data/train-00006-of-00024-10bce60250b577c5.parquet with huggingface_hub
Upload data/train-00005-of-00024-6c2f3b8bc560a4f3.parquet with huggingface_hub
Upload data/train-00004-of-00024-d3450669d0bf3a26.parquet with huggingface_hub
Upload data/train-00003-of-00024-340bde3f89a2fbf5.parquet with huggingface_hub
Upload data/train-00002-of-00024-e1f03c1a1d7a6f34.parquet with huggingface_hub
Upload data/train-00001-of-00024-1d2e41eb86ed9aae.parquet with huggingface_hub
Upload data/train-00000-of-00024-12301fa50e8fb225.parquet with huggingface_hub
initial commit
