LTCB/enwik8
The dataset is based on the Hutter Prize (http://prize.hutter1.net) and contains the first 10^8 bytes of English Wikipedia in 2006 in XML
14395
Delete legacy JSON metadata (#5)
Convert missing dataset sizes from base 2 to base 10 in the dataset card (#3)
Convert dataset sizes from base 2 to base 10 in the dataset card (#2)
add dataset_info in dataset metadata
remove dummmy data
Update Enwik8 broken link and information (#4950)
Align more metadata with other repo types (models,spaces) (#4607)
Adding dataset enwik8 (#4321)
initial commit
