CoolFace
23 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01tmquan /nso-gov-vn nso-gov-vn — Vietnam NSO PX-Web mirror · Bản sao PX-Web của Tổng cục Thống kê 🇻🇳 Tóm tắt. Bản sao đầy đủ, từng bảng một, của cơ sở dữ liệu thống kê PX-Web của Tổng cục Thống kê Việt Nam (NSO / GSO) tại https://pxweb.nso.gov.vn. Mỗi ma trận PX-Web (multi-dimensional data cube) được phơi ra cùng lúc ở (i) bản gốc với schema riêng và (ii) định dạng long-format gộp chung, để bạn có thể chọn giữa "nguyên trạng" hay "join sẵn". 🇬🇧 Summary. A complete, table-by-table mirror of the… See the full description on the dataset page: https://huggingface.co/datasets/tmquan/nso-gov-vn.tabulartabular-classification100K<n<1M0 likes1k downloads5mo agoHugging Face02mnlp-nsoai /mmlu-pro-augmentationtabular10K<n<100K0 likes151 downloads2y agoHugging Face03mnlp-nsoai /rag-embeddings-and-texttext100K<n<1M1 likes51 downloads2y agoHugging Face04danielshaps /nchlt_speech_nso NCHLT Speech Corpus -- Sepedi This is the Sepedi language part of the NCHLT Speech Corpus of the South African languages. Language code (ISO 639): nso URI: https://hdl.handle.net/20.500.12185/270 Licence: Creative Commons Attribution 3.0 Unported License (CC BY 3.0): http://creativecommons.org/licenses/by/3.0/legalcode Attribution: The Department of Arts and Culture of the government of the Republic of South Africa (DAC), Council for Scientific and Industrial… See the full description on the dataset page: https://huggingface.co/datasets/danielshaps/nchlt_speech_nso.audioautomatic-speech-recognition10K<n<100K0 likes42 downloads2y agoHugging Face05mnlp-nsoai /m3-scientific-sft-mcqatext10K<n<100K1 likes39 downloads2y agoHugging Face06mnlp-nsoai /hf-dpo-pairs-collectiontexttext-generation10K<n<100K0 likes36 downloads2y agoHugging Face07mnlp-nsoai /dpo-student-preference-pairstext10K<n<100K0 likes32 downloads2y agoHugging Face08mnlp-nsoai /wikiscrape1000-oatext1K<n<10K0 likes27 downloads2y agoHugging Face09mnlp-nsoai /allenai-math_qa-1000textn<1K1 likes21 downloads2y agoHugging Face10africa-intelligence /yahma-alpaca-cleaned-nso Terms of Use This model is governed by a Apache 2.0 License. text10K<n<100K0 likes17 downloads2y agoHugging Face11mnlp-nsoai /allenai-qasc-1000text1K<n<10K0 likes14 downloads2y agoHugging Face12mnlp-nsoai /commonsenseqa-1000text1K<n<10K0 likes14 downloads2y agoHugging Face13mnlp-nsoai /MMLU-STEM-1000text1K<n<10K0 likes13 downloads2y agoHugging Face14YxBxRyXJx /NSOARTC_Tanshi_TEST_0107tabular1K<n<10K0 likes12 downloads2y agoHugging Face15mnlp-nsoai /wikiscrape1000-mcqtext1K<n<10K0 likes9 downloads2y agoHugging Face16mnlp-nsoai /openai-subset-gsm1ktext1K<n<10K0 likes9 downloads2y agoHugging Face17mnlp-nsoai /openlifescienceai-medmcqa-1000text1K<n<10K0 likes9 downloads2y agoHugging Face18YxBxRyXJx /NSOARTC_Tanshi_1221tabular1K<n<10K0 likes9 downloads2y agoHugging Face19BabyLM-community /babylm-nsogated babylm-nso Dataset Description This dataset is part of the BabyLM multilingual collection. Dataset Summary Language: nso Script: Latin Number of Documents: 26772 Total Tokens: 1067761 Tokens Per Category child-books: 122083 tokens child-news: 130 tokens educational: 92589 tokens padding-mt: 206703 tokens padding-news: 150960 tokens padding-wikipedia: 495296 tokens Data Fields text: The document text category: Type of content (e.g.… See the full description on the dataset page: https://huggingface.co/datasets/BabyLM-community/babylm-nso.texttext-generation10K<n<100K0 likes8 downloads11mo agoHugging Face20mnlp-nsoai /rag-text-chunkstext100K<n<1M0 likes5 downloads2y agoHugging Face21N03N9 /cv24-nso-128-normalizedtextn<1K0 likes5 downloads9mo agoHugging Face22Nsohko /NSC_sample_0audion<1K0 likes3 downloads3y agoHugging Face23mnlp-nsoai /dpo-student-preferencesgatedtext10K<n<100K0 likes2 downloads2y agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.