CoolFace
Datasetpublicgated

glossAPI/Ellinika_Keimena_Project_Gutenberg

Ellinika Keimena – Project Gutenberg Greek Text Corpus Πληροφορίες για τα δεδομένα Το παρόν dataset περιλαμβάνει 214 κείμενα σε όλες τις ποικιλίες της ελληνικής γλώσσας (Αρχαία, Καθαρεύουσα, Δημοτική, ΚΝΕ). Τα κείμενα αντλήθηκαν από το Project Gutenberg και αφορούν έργα της ελληνικής γραμματείας και δοκίμια που έχουν αποχαρακτηριστεί ως πνευματική ιδιοκτησία. Τα αρχεία προσφέρονται σε μορφή parquet μαζί με τα μεταδεδομένα τους όπως συγγραφέας / μεταφραστής, χρονολογία… See the full description on the dataset page: https://huggingface.co/datasets/glossAPI/Ellinika_Keimena_Project_Gutenberg.

sourceHugging Facecc-by-4.0updated 2mo agoView on Hugging Face
0likes11downloads

No commit history came back for main. The revision may not exist, or the source declined the request.