CoolFace
Datasetpublic

csebuetnlp/xlsum

We present XLSum, a comprehensive and diverse dataset comprising 1.35 million professionally annotated article-summary pairs from BBC, extracted using a set of carefully designed heuristics. The dataset covers 45 languages ranging from low to high-resource, for many of which no public dataset is currently available. XL-Sum is highly abstractive, concise, and of high quality, as indicated by human and intrinsic evaluation.

sourceHugging Facecc-by-nc-sa-4.0updated 3y agoView on Hugging Face
160likes4.1kdownloads
10 commits on main
30fece43y ago

Fix task tags (#3)

abhik1505040, albertvillanova
33bf2124y ago

Fix `license` metadata (#1)

Tahmid, julien-c
d5beacc5y ago

Updated README.md

abhik1505040
c78fca45y ago

Updated language codes

abhik1505040
68f72f35y ago

Merge branch 'main' of https://huggingface.co/datasets/csebuetnlp/xlsum into main

abhik1505040
b59185c5y ago

Added metadata

abhik1505040
6cccd3c5y ago

Update README.md

Tahmid
22c17245y ago

Added README.md

abhik1505040
16f84e65y ago

Initial commit

abhik1505040
93108de5y ago

initial commit

system