seonglae/wikipedia_token
Dataset Card for "wikipedia_token" Token count { '~1024': 5320881, '1024~2048': 693911, '2048~4096': 300935, '4096~8192': 106221, '8192~16384': 30611, '16384~32768': 4812, '32768~65536': 1253, '65536~128000': 46, '128000~': 0 } Text count { '0~1024': 2751539, '1024~2048': 1310778, '2048~4096': 1179150, '4096~8192': 722101, '8192~16384': 329062, '16384~32768': 121237, '32768~65536': 36894, '65536~': 7909 } Token percent {… See the full description on the dataset page: https://huggingface.co/datasets/seonglae/wikipedia_token.
Update README.md
Upload README.md with huggingface_hub
Delete gpt-4/train-00000-of-00001-77627140d05d91a9.parquet with huggingface_hub
Upload gpt-4/train-00039-of-00040-a1594bb811551650.parquet with huggingface_hub
Upload gpt-4/train-00038-of-00040-a3a6b1093a1bf01e.parquet with huggingface_hub
Upload gpt-4/train-00037-of-00040-af116d9cc80023e9.parquet with huggingface_hub
Upload gpt-4/train-00036-of-00040-d79df118c1bda8a3.parquet with huggingface_hub
Upload gpt-4/train-00035-of-00040-2f55a35ecfa8ce7a.parquet with huggingface_hub
Upload gpt-4/train-00034-of-00040-5461feeafc0e0693.parquet with huggingface_hub
Upload gpt-4/train-00033-of-00040-f16f93f43d82be06.parquet with huggingface_hub
Upload gpt-4/train-00032-of-00040-93fa82e08323aac6.parquet with huggingface_hub
Upload gpt-4/train-00031-of-00040-d70a0c746045549e.parquet with huggingface_hub
Upload gpt-4/train-00030-of-00040-83318750cce28d4c.parquet with huggingface_hub
Upload gpt-4/train-00029-of-00040-8aa5cd7822417147.parquet with huggingface_hub
Upload gpt-4/train-00028-of-00040-38134f3c152c6223.parquet with huggingface_hub
Upload gpt-4/train-00027-of-00040-c5a4eca598c64828.parquet with huggingface_hub
Upload gpt-4/train-00026-of-00040-f65a7ae1d952b230.parquet with huggingface_hub
Upload gpt-4/train-00025-of-00040-1c0719e914f3b8a5.parquet with huggingface_hub
Upload gpt-4/train-00024-of-00040-97771b8e7f6d9d5e.parquet with huggingface_hub
Upload gpt-4/train-00023-of-00040-774c2091a83fdf00.parquet with huggingface_hub
Upload gpt-4/train-00022-of-00040-b0fc294fa0ba8032.parquet with huggingface_hub
Upload gpt-4/train-00021-of-00040-4ea03ca4991a93b7.parquet with huggingface_hub
Upload gpt-4/train-00020-of-00040-35e8ec5f7c0ad651.parquet with huggingface_hub
Upload gpt-4/train-00019-of-00040-cb6a9659babf8430.parquet with huggingface_hub
Upload gpt-4/train-00018-of-00040-7c34e284dd9eebfc.parquet with huggingface_hub
Upload gpt-4/train-00017-of-00040-b8753cace20cafc6.parquet with huggingface_hub
Upload gpt-4/train-00016-of-00040-55c7a22103218937.parquet with huggingface_hub
Upload gpt-4/train-00015-of-00040-890cc5b64901a8d2.parquet with huggingface_hub
Upload gpt-4/train-00014-of-00040-d0a55c8216abfb49.parquet with huggingface_hub
Upload gpt-4/train-00013-of-00040-acc38045c765f69d.parquet with huggingface_hub
Upload gpt-4/train-00012-of-00040-51fa28029e4986f8.parquet with huggingface_hub
Upload gpt-4/train-00011-of-00040-02d968cf152b7c59.parquet with huggingface_hub
Upload gpt-4/train-00010-of-00040-2b63fe08fe6b5376.parquet with huggingface_hub
Upload gpt-4/train-00009-of-00040-a59c62aa24e38f26.parquet with huggingface_hub
Upload gpt-4/train-00008-of-00040-ccc6d147cc36ede3.parquet with huggingface_hub
Upload gpt-4/train-00007-of-00040-2439503879cdbbfd.parquet with huggingface_hub
Upload gpt-4/train-00006-of-00040-0bcd93a6af7027bc.parquet with huggingface_hub
Upload gpt-4/train-00005-of-00040-255b02d448ad614a.parquet with huggingface_hub
Upload gpt-4/train-00004-of-00040-c4c404abd3ccfb82.parquet with huggingface_hub
Upload gpt-4/train-00003-of-00040-1c175c5498372cb5.parquet with huggingface_hub
Upload gpt-4/train-00002-of-00040-7a4e2cf5be8708c0.parquet with huggingface_hub
Upload gpt-4/train-00001-of-00040-52f12d7562ed2b84.parquet with huggingface_hub
Upload gpt-4/train-00000-of-00040-22fd3b872fc16b30.parquet with huggingface_hub
Upload README.md with huggingface_hub
Upload gpt-4/train-00000-of-00001-77627140d05d91a9.parquet with huggingface_hub
initial commit
