CoolFace
Datasetpublic

nazimali/kurdish-english-opus-100

Summary Extracted subset from Helsinki-NLP/opus-100 and reshaped it into 2 columns. Note: noticed some low quality pairs. It would be a good project to classify and select high quality pairs. Usage from datasets import load_dataset ds = load_dataset("nazimali/kurdish-english-opus-100", split="train") ds Dataset({ features: ['english', 'kurdish'], num_rows: 148844 })

sourceHugging Faceupdated 2y agoView on Hugging Face
1likes267downloads
Dataset Card

Summary

Extracted subset from Helsinki-NLP/opus-100 and reshaped it into 2 columns. Note: noticed some low quality pairs. It would be a good project to classify and select high quality pairs.

Usage

python
from datasets import load_dataset

ds = load_dataset("nazimali/kurdish-english-opus-100", split="train")
ds
python
Dataset({
    features: ['english', 'kurdish'],
    num_rows: 148844
})