CogComp/trec
The Text REtrieval Conference (TREC) Question Classification dataset contains 5500 labeled questions in training set and another 500 for test set. The dataset has 6 coarse class labels and 50 fine class labels. Average length of each sentence is 10, vocabulary size of 8700. Data are collected from four sources: 4,500 English questions published by USC (Hovy et al., 2001), about 500 manually constructed questions for a few rare classes, 894 TREC 8 and TREC 9 questions, and also 500 questions from TREC 10 which serves as the test set. These questions were manually labeled.
4818k
1*.7z filter=lfs diff=lfs merge=lfs -text2*.arrow filter=lfs diff=lfs merge=lfs -text3*.bin filter=lfs diff=lfs merge=lfs -text4*.bin.* filter=lfs diff=lfs merge=lfs -text5*.bz2 filter=lfs diff=lfs merge=lfs -text6*.ftz filter=lfs diff=lfs merge=lfs -text7*.gz filter=lfs diff=lfs merge=lfs -text8*.h5 filter=lfs diff=lfs merge=lfs -text9*.joblib filter=lfs diff=lfs merge=lfs -text10*.lfs.* filter=lfs diff=lfs merge=lfs -text11*.model filter=lfs diff=lfs merge=lfs -text12*.msgpack filter=lfs diff=lfs merge=lfs -text13*.onnx filter=lfs diff=lfs merge=lfs -text14*.ot filter=lfs diff=lfs merge=lfs -text15*.parquet filter=lfs diff=lfs merge=lfs -text16*.pb filter=lfs diff=lfs merge=lfs -text17*.pt filter=lfs diff=lfs merge=lfs -text18*.pth filter=lfs diff=lfs merge=lfs -text19*.rar filter=lfs diff=lfs merge=lfs -text20saved_model/**/* filter=lfs diff=lfs merge=lfs -text21*.tar.* filter=lfs diff=lfs merge=lfs -text22*.tflite filter=lfs diff=lfs merge=lfs -text23*.tgz filter=lfs diff=lfs merge=lfs -text24*.xz filter=lfs diff=lfs merge=lfs -text25*.zip filter=lfs diff=lfs merge=lfs -text26*.zstandard filter=lfs diff=lfs merge=lfs -text27*tfevents* filter=lfs diff=lfs merge=lfs -text28 