CoolFace
Datasetpublic

CogComp/trec

The Text REtrieval Conference (TREC) Question Classification dataset contains 5500 labeled questions in training set and another 500 for test set. The dataset has 6 coarse class labels and 50 fine class labels. Average length of each sentence is 10, vocabulary size of 8700. Data are collected from four sources: 4,500 English questions published by USC (Hovy et al., 2001), about 500 manually constructed questions for a few rare classes, 894 TREC 8 and TREC 9 questions, and also 500 questions from TREC 10 which serves as the test set. These questions were manually labeled.

sourceHugging Faceunknownupdated 3y agoView on Hugging Face
48likes18kdownloads
.gitattributes28 linesDownload Raw Back to root
1*.7z filter=lfs diff=lfs merge=lfs -text2*.arrow filter=lfs diff=lfs merge=lfs -text3*.bin filter=lfs diff=lfs merge=lfs -text4*.bin.* filter=lfs diff=lfs merge=lfs -text5*.bz2 filter=lfs diff=lfs merge=lfs -text6*.ftz filter=lfs diff=lfs merge=lfs -text7*.gz filter=lfs diff=lfs merge=lfs -text8*.h5 filter=lfs diff=lfs merge=lfs -text9*.joblib filter=lfs diff=lfs merge=lfs -text10*.lfs.* filter=lfs diff=lfs merge=lfs -text11*.model filter=lfs diff=lfs merge=lfs -text12*.msgpack filter=lfs diff=lfs merge=lfs -text13*.onnx filter=lfs diff=lfs merge=lfs -text14*.ot filter=lfs diff=lfs merge=lfs -text15*.parquet filter=lfs diff=lfs merge=lfs -text16*.pb filter=lfs diff=lfs merge=lfs -text17*.pt filter=lfs diff=lfs merge=lfs -text18*.pth filter=lfs diff=lfs merge=lfs -text19*.rar filter=lfs diff=lfs merge=lfs -text20saved_model/**/* filter=lfs diff=lfs merge=lfs -text21*.tar.* filter=lfs diff=lfs merge=lfs -text22*.tflite filter=lfs diff=lfs merge=lfs -text23*.tgz filter=lfs diff=lfs merge=lfs -text24*.xz filter=lfs diff=lfs merge=lfs -text25*.zip filter=lfs diff=lfs merge=lfs -text26*.zstandard filter=lfs diff=lfs merge=lfs -text27*tfevents* filter=lfs diff=lfs merge=lfs -text28