crosslingual-rule-following/canonical-dataset
canonical-dataset A parallel, multilingual dataset on rule-following Languages en — English am — Amharic de — German hi — Hindi ig — Igbo it — Italian ko — Korean ru — Russian sw — Swahili ta — Tamil tr — Turkish ur — Urdu yo — Yoruba Loading from datasets import load_dataset en = load_dataset("canonical-dataset", "en", split="test") yo = load_dataset("canonical-dataset", "yo", split="test")
0175
canonical-dataset
A parallel, multilingual dataset on rule-following
Languages
en— Englisham— Amharicde— Germanhi— Hindiig— Igboit— Italianko— Koreanru— Russiansw— Swahilita— Tamiltr— Turkishur— Urduyo— Yoruba
Loading
from datasets import load_dataset
en = load_dataset("canonical-dataset", "en", split="test")
yo = load_dataset("canonical-dataset", "yo", split="test")