masakhane/InjongoIntent
Dataset Card for InjongoIntent Dataset Summary InjongoIntent Languages There are 17 languages available : Dataset Structure Data Instances The examples look like this for English: from datasets import load_dataset data = load_dataset('masakhane/InjongoIntent', 'eng') # Please, specify the language code # A data point example is below: { } Data Fields question: the question string to a grade school… See the full description on the dataset page: https://huggingface.co/datasets/masakhane/InjongoIntent.
1454
1---2license: apache-2.03language:4- am5- ee6- ha7- ig8- rw9- ln10- lg11- om12- sn13- st14- sw15- tw16- wo17- xh18- yo19- zu20- en21multilinguality:22- multilingual23pretty_name: injongoIntent24size_categories:25- n<1K26language_details: >-27 amh, eng, ewe, hau, ibo, kin, lin, lug, orm, sna, sot, swa, twi, wol, xho, yor, zul28source_datasets:29- clinc/clinc_oos30tags:31- injongoIntent32- injongo-intent33- injongointent34task_categories:35- text-classification36task_ids:37- intent-classification38- multi-class-classification39configs:40- config_name: amh41 data_files:42 - split: train43 path: amh/train.jsonl44 - split: validation45 path: amh/dev.jsonl46 - split: test47 path: amh/test.jsonl48- config_name: eng49 data_files:50 - split: train51 path: eng/train.jsonl52 - split: test53 path: eng/test.jsonl54- config_name: ewe55 data_files:56 - split: train57 path: ewe/train.jsonl58 - split: validation59 path: ewe/dev.jsonl60 - split: test61 path: ewe/test.jsonl62- config_name: hau63 data_files:64 - split: train65 path: hau/train.jsonl66 - split: validation67 path: hau/dev.jsonl68 - split: test69 path: hau/test.jsonl70- config_name: ibo71 data_files:72 - split: train73 path: ibo/train.jsonl74 - split: validation75 path: ibo/dev.jsonl76 - split: test77 path: ibo/test.jsonl78- config_name: kin79 data_files:80 - split: train81 path: kin/train.jsonl82 - split: validation83 path: kin/dev.jsonl84 - split: test85 path: kin/test.jsonl86- config_name: lin87 data_files:88 - split: train89 path: lin/train.jsonl90 - split: validation91 path: lin/dev.jsonl92 - split: test93 path: lin/test.jsonl94- config_name: lug95 data_files:96 - split: train97 path: lug/train.jsonl98 - split: validation99 path: lug/dev.jsonl100 - split: test101 path: lug/test.jsonl102- config_name: orm103 data_files:104 - split: train105 path: orm/train.jsonl106 - split: validation107 path: orm/dev.jsonl108 - split: test109 path: orm/test.jsonl110- config_name: sna111 data_files:112 - split: train113 path: sna/train.jsonl114 - split: validation115 path: sna/dev.jsonl116 - split: test117 path: sna/test.jsonl118- config_name: sot119 data_files:120 - split: train121 path: sot/train.jsonl122 - split: validation123 path: sot/dev.jsonl124 - split: test125 path: sot/test.jsonl126- config_name: swa127 data_files:128 - split: train129 path: swa/train.jsonl130 - split: validation131 path: swa/dev.jsonl132 - split: test133 path: swa/test.jsonl134- config_name: twi135 data_files:136 - split: train137 path: twi/train.jsonl138 - split: validation139 path: twi/dev.jsonl140 - split: test141 path: twi/test.jsonl142- config_name: wol143 data_files:144 - split: train145 path: wol/train.jsonl146 - split: validation147 path: wol/dev.jsonl148 - split: test149 path: wol/test.jsonl150- config_name: xho151 data_files:152 - split: train153 path: xho/train.jsonl154 - split: validation155 path: xho/dev.jsonl156 - split: test157 path: xho/test.jsonl158- config_name: yor159 data_files:160 - split: train161 path: yor/train.jsonl162 - split: validation163 path: yor/dev.jsonl164 - split: test165 path: yor/test.jsonl166- config_name: zul167 data_files:168 - split: train169 path: zul/train.jsonl170 - split: validation171 path: zul/dev.jsonl172 - split: test173 path: zul/test.jsonl174---175 176# Dataset Card for InjongoIntent177 178## Table of Contents179- [Table of Contents](#table-of-contents)180- [Dataset Description](#dataset-description)181 - [Dataset Summary](#dataset-summary)182 - [Languages](#languages)183- [Dataset Structure](#dataset-structure)184 - [Data Instances](#data-instances)185 - [Data Fields](#data-fields)186 - [Data Splits](#data-splits)187 188## Dataset Description189 190- **Point of Contact:** david.adelani@mila.quebec191 192### Dataset Summary193 194InjongoIntent195 196### Languages197 198There are 17 languages available :199 200## Dataset Structure201 202### Data Instances203 204The examples look like this for English:205 206```207from datasets import load_dataset208data = load_dataset('masakhane/InjongoIntent', 'eng') 209# Please, specify the language code210# A data point example is below:211{212 213}214```215 216### Data Fields217 218- `question`: the question string to a grade school math problem.219- `answer`: the final numeric solution.220 221### Data Splits222 223All languages has two split the `train` and `test` and they correspond with the original `train` and `test` splits of the GSM8k dataset.224 225The splits have the following sizes :226 227| Language | train | test |228|----------|------:|-----:|229| am | 8 | 250 |230| ee | 8 | 250 |231| ha | 8 | 250 |232| kin | 8 | 250 |233| ln | 8 | 250 |234| lug | 8 | 250 |235| orm | 8 | 250 |236| sna | 8 | 250 |237| sw | 8 | 250 |238| tw | 8 | 250 |239| vai | 8 | 250 |240| wo | 8 | 250 |241| xh | 8 | 250 |242| yo | 8 | 250 |243| zu | 8 | 250 |244| en | 8 | 250 |245 