CoolFace
Datasetpublic

statworx/leipzip-swiss

Dataset Card for Leipzig Corpora Swiss German Dataset Summary Swiss German Wikipedia corpus based on material from 2021.The corpus gsw_wikipedia_2021 is a Swiss German Wikipedia corpus based on material from 2021. It contains 232,933 sentences and 3,824,547 tokens. Languages Swiss-German Dataset Structure Data Instances Single sentences. Data Fields sentence: Text as string. Data Splits… See the full description on the dataset page: https://huggingface.co/datasets/statworx/leipzip-swiss.

sourceHugging Faceccupdated 4y agoView on Hugging Face
2likes17downloads
14 commits on main
546dd4d4y ago

Update README.md

fabianmmueller
8c994414y ago

Upload README.md

fabianmmueller
d0bae284y ago

Upload README.md with huggingface_hub

fabianmmueller
421c5264y ago

Delete data/train-00000-of-00001-e0d4961569c52e69.parquet with huggingface_hub

fabianmmueller
0291b4a4y ago

Upload data/train-00000-of-00001-0d60107f007bed33.parquet with huggingface_hub

fabianmmueller
a771ed84y ago

Upload README.md with huggingface_hub

fabianmmueller
2e02bea4y ago

Delete data/train-00000-of-00001-0d60107f007bed33.parquet with huggingface_hub

fabianmmueller
752b3994y ago

Upload data/train-00000-of-00001-e0d4961569c52e69.parquet with huggingface_hub

fabianmmueller
24d13e44y ago

Upload README.md with huggingface_hub

fabianmmueller
bbd5e944y ago

Delete data/train-00000-of-00001-351f887adb0d40c6.parquet with huggingface_hub

fabianmmueller
6066b274y ago

Upload data/train-00000-of-00001-0d60107f007bed33.parquet with huggingface_hub

fabianmmueller
a708e5b4y ago

Upload README.md with huggingface_hub

fabianmmueller
f9586ac4y ago

Upload data/train-00000-of-00001-351f887adb0d40c6.parquet with huggingface_hub

fabianmmueller
2b66a1a4y ago

initial commit

fabianmmueller