nazimali/kurdish-english-opus-100
Summary Extracted subset from Helsinki-NLP/opus-100 and reshaped it into 2 columns. Note: noticed some low quality pairs. It would be a good project to classify and select high quality pairs. Usage from datasets import load_dataset ds = load_dataset("nazimali/kurdish-english-opus-100", split="train") ds Dataset({ features: ['english', 'kurdish'], num_rows: 148844 })
1267
Summary
Extracted subset from Helsinki-NLP/opus-100 and reshaped it into 2 columns. Note: noticed some low quality pairs. It would be a good project to classify and select high quality pairs.
Usage
from datasets import load_dataset
ds = load_dataset("nazimali/kurdish-english-opus-100", split="train")
dsDataset({
features: ['english', 'kurdish'],
num_rows: 148844
})