CoolFace
Datasetpublic

singletongue/wikipedia-paragraphs

wikipedia-paragraphs wikipedia-paragraphs is a dataset generated from Wikipedia, designed for natural language processing (NLP) research. Each entry contains cleaned paragraph text and Wikilink information extracted from a Wikipedia page, along with useful metadata such as categories, templates, and the associated Wikidata QID. Dataset structure Configurations The dataset is organized into multiple configurations, such as enwiki-20260607-v1.2.1.… See the full description on the dataset page: https://huggingface.co/datasets/singletongue/wikipedia-paragraphs.

sourceHugging Facecc-by-sa-4.0updated 3mo agoView on Hugging Face
2likes10kdownloads
settings

This repository belongs to singletongue on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namewikipedia-paragraphs
visibilitypublic
licencecc-by-sa-4.0
gatedno
ownersingletongue
Account settings
singletongue/wikipedia-paragraphs · CoolFace