CoolFace
Datasetpublic

botisan-ai/cantonese-mandarin-translations

Dataset Card for cantonese-mandarin-translations Dataset Summary This is a machine-translated parallel corpus between Cantonese (a Chinese dialect that is mainly spoken by Guangdong (province of China), Hong Kong, Macau and part of Malaysia) and Chinese (written form, in Simplified Chinese). Supported Tasks and Leaderboards N/A Languages Cantonese (yue) Simplified Chinese (zh-CN) Dataset Structure JSON lines with yue… See the full description on the dataset page: https://huggingface.co/datasets/botisan-ai/cantonese-mandarin-translations.

sourceHugging Facecc-by-nc-sa-4.0updated 3y agoView on Hugging Face
31likes112downloads
settings

This repository belongs to botisan-ai on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namecantonese-mandarin-translations
visibilitypublic
licencecc-by-nc-sa-4.0
gatedno
ownerbotisan-ai
Account settings
botisan-ai/cantonese-mandarin-translations · CoolFace