CoolFace
Datasetpublic

yilmazzey/arxiv_summarization_20k_preprocessed

ArXiv Summarization Dataset - 20K Preprocessed A preprocessed dataset of 20,000 ArXiv papers with their full articles and abstracts, designed for abstract generation and summarization tasks. Dataset Description This dataset contains 20,000 ArXiv papers that have been filtered and preprocessed to ensure quality for training summarization models. Each example contains the full article text and its corresponding abstract. Dataset Structure The dataset… See the full description on the dataset page: https://huggingface.co/datasets/yilmazzey/arxiv_summarization_20k_preprocessed.

sourceHugging Facemitupdated 10mo agoView on Hugging Face
0likes14downloads
settings

This repository belongs to yilmazzey on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namearxiv_summarization_20k_preprocessed
visibilitypublic
licencemit
gatedno
owneryilmazzey
Account settings
yilmazzey/arxiv_summarization_20k_preprocessed · CoolFace