CoolFace
Datasetpublic

bingbangboom/adaption-hinglish-transliterate-dataset

Adaption Hinglish Transliterate Dataset Dataset Description This dataset contains 77,471 pairs of raw Hindi text captured via Automatic Speech Recognition (ASR) in Devanagari script and their corresponding clean transliterations into Romanized Hinglish. The samples demonstrate the correction of ASR artifacts and the application of Anglicized Hinglish conventions while preserving the original meaning. Each entry consists of an original system prompt instructing… See the full description on the dataset page: https://huggingface.co/datasets/bingbangboom/adaption-hinglish-transliterate-dataset.

sourceHugging Facecc-by-sa-4.0updated 3mo agoView on Hugging Face
1likes58downloads
settings

This repository belongs to bingbangboom on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

nameadaption-hinglish-transliterate-dataset
visibilitypublic
licencecc-by-sa-4.0
gatedno
ownerbingbangboom
Account settings
bingbangboom/adaption-hinglish-transliterate-dataset · CoolFace