CoolFace
Datasetpublic

taqiyudinadn/EOS-Continued-Pretraining-Dataset

EOS Continued Pre-Training Dataset (Indonesia) Deskripsi Dataset EOS Continued Pre-Training Dataset adalah korpus teks bahasa Indonesia yang dikurasi untuk proses Continued Pre-Training (CPT) pada Large Language Models (LLM). Tujuan utama dari dataset ini adalah untuk melakukan Domain Adaptation, yaitu meningkatkan kemampuan model dalam memahami konteks, terminologi, dan nuansa pada dua domain strategis di Indonesia: Pengawasan Ruang Digital (PRD) Digital Talent… See the full description on the dataset page: https://huggingface.co/datasets/taqiyudinadn/EOS-Continued-Pretraining-Dataset.

sourceHugging Faceapache-2.0updated 9mo agoView on Hugging Face
0likes11downloads
settings

This repository belongs to taqiyudinadn on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

nameEOS-Continued-Pretraining-Dataset
visibilitypublic
licenceapache-2.0
gatedno
ownertaqiyudinadn
Account settings
taqiyudinadn/EOS-Continued-Pretraining-Dataset · CoolFace