CoolFace
Datasetpublic

masakhane/InjongoIntent

Dataset Card for InjongoIntent Dataset Summary InjongoIntent Languages There are 17 languages available : Dataset Structure Data Instances The examples look like this for English: from datasets import load_dataset data = load_dataset('masakhane/InjongoIntent', 'eng') # Please, specify the language code # A data point example is below: { } Data Fields question: the question string to a grade school… See the full description on the dataset page: https://huggingface.co/datasets/masakhane/InjongoIntent.

sourceHugging Faceapache-2.0updated 2y agoView on Hugging Face
1likes454downloads
README.md245 linesDownload Raw Back to root
1---2license: apache-2.03language:4- am5- ee6- ha7- ig8- rw9- ln10- lg11- om12- sn13- st14- sw15- tw16- wo17- xh18- yo19- zu20- en21multilinguality:22- multilingual23pretty_name: injongoIntent24size_categories:25- n<1K26language_details: >-27  amh, eng, ewe, hau, ibo, kin, lin, lug, orm, sna, sot, swa, twi, wol, xho, yor, zul28source_datasets:29- clinc/clinc_oos30tags:31- injongoIntent32- injongo-intent33- injongointent34task_categories:35- text-classification36task_ids:37- intent-classification38- multi-class-classification39configs:40- config_name: amh41  data_files:42  - split: train43    path: amh/train.jsonl44  - split: validation45    path: amh/dev.jsonl46  - split: test47    path: amh/test.jsonl48- config_name: eng49  data_files:50  - split: train51    path: eng/train.jsonl52  - split: test53    path: eng/test.jsonl54- config_name: ewe55  data_files:56  - split: train57    path: ewe/train.jsonl58  - split: validation59    path: ewe/dev.jsonl60  - split: test61    path: ewe/test.jsonl62- config_name: hau63  data_files:64  - split: train65    path: hau/train.jsonl66  - split: validation67    path: hau/dev.jsonl68  - split: test69    path: hau/test.jsonl70- config_name: ibo71  data_files:72  - split: train73    path: ibo/train.jsonl74  - split: validation75    path: ibo/dev.jsonl76  - split: test77    path: ibo/test.jsonl78- config_name: kin79  data_files:80  - split: train81    path: kin/train.jsonl82  - split: validation83    path: kin/dev.jsonl84  - split: test85    path: kin/test.jsonl86- config_name: lin87  data_files:88  - split: train89    path: lin/train.jsonl90  - split: validation91    path: lin/dev.jsonl92  - split: test93    path: lin/test.jsonl94- config_name: lug95  data_files:96  - split: train97    path: lug/train.jsonl98  - split: validation99    path: lug/dev.jsonl100  - split: test101    path: lug/test.jsonl102- config_name: orm103  data_files:104  - split: train105    path: orm/train.jsonl106  - split: validation107    path: orm/dev.jsonl108  - split: test109    path: orm/test.jsonl110- config_name: sna111  data_files:112  - split: train113    path: sna/train.jsonl114  - split: validation115    path: sna/dev.jsonl116  - split: test117    path: sna/test.jsonl118- config_name: sot119  data_files:120  - split: train121    path: sot/train.jsonl122  - split: validation123    path: sot/dev.jsonl124  - split: test125    path: sot/test.jsonl126- config_name: swa127  data_files:128  - split: train129    path: swa/train.jsonl130  - split: validation131    path: swa/dev.jsonl132  - split: test133    path: swa/test.jsonl134- config_name: twi135  data_files:136  - split: train137    path: twi/train.jsonl138  - split: validation139    path: twi/dev.jsonl140  - split: test141    path: twi/test.jsonl142- config_name: wol143  data_files:144  - split: train145    path: wol/train.jsonl146  - split: validation147    path: wol/dev.jsonl148  - split: test149    path: wol/test.jsonl150- config_name: xho151  data_files:152  - split: train153    path: xho/train.jsonl154  - split: validation155    path: xho/dev.jsonl156  - split: test157    path: xho/test.jsonl158- config_name: yor159  data_files:160  - split: train161    path: yor/train.jsonl162  - split: validation163    path: yor/dev.jsonl164  - split: test165    path: yor/test.jsonl166- config_name: zul167  data_files:168  - split: train169    path: zul/train.jsonl170  - split: validation171    path: zul/dev.jsonl172  - split: test173    path: zul/test.jsonl174---175 176# Dataset Card for InjongoIntent177 178## Table of Contents179- [Table of Contents](#table-of-contents)180- [Dataset Description](#dataset-description)181  - [Dataset Summary](#dataset-summary)182  - [Languages](#languages)183- [Dataset Structure](#dataset-structure)184  - [Data Instances](#data-instances)185  - [Data Fields](#data-fields)186  - [Data Splits](#data-splits)187 188## Dataset Description189 190- **Point of Contact:** david.adelani@mila.quebec191 192### Dataset Summary193 194InjongoIntent195 196### Languages197 198There are 17 languages available :199 200## Dataset Structure201 202### Data Instances203 204The examples look like this for English:205 206```207from datasets import load_dataset208data = load_dataset('masakhane/InjongoIntent', 'eng') 209# Please, specify the language code210# A data point example is below:211{212 213}214```215 216### Data Fields217 218- `question`: the question string to a grade school math problem.219- `answer`: the final numeric solution.220 221### Data Splits222 223All languages has two split the `train` and `test` and they correspond with the original `train` and `test` splits of the GSM8k dataset.224 225The splits have the following sizes :226 227| Language | train | test |228|----------|------:|-----:|229| am       |     8 |  250 |230| ee       |     8 |  250 |231| ha       |     8 |  250 |232| kin      |     8 |  250 |233| ln       |     8 |  250 |234| lug      |     8 |  250 |235| orm      |     8 |  250 |236| sna      |     8 |  250 |237| sw       |     8 |  250 |238| tw       |     8 |  250 |239| vai      |     8 |  250 |240| wo       |     8 |  250 |241| xh       |     8 |  250 |242| yo       |     8 |  250 |243| zu       |     8 |  250 |244| en       |     8 |  250 |245