datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
embedded_textembedded_faqs_medicareembedded_faqs_komcadv1embedded_azure_interviewembedded_faqs_telcoembedded_faqs_medicareembedded_faqs_medicareembedded_faqs_medicareEmbedded_Clauses-dolma_v1_6-sampleembedded_faqs_medicarejp-news-embedded-clause-corpus
license: cc-by-nc-4.0
Japanese News Embedded Clause Corpus
Description
This dataset is a manually annotated corpus of embedded clauses extracted from Japanese news texts.
The corpus was developed to support Japanese language teachers, corpus linguistics research, and natural language processing research.
Annotation Labels
MAIN : Matrix clause
NC : Noun complement clause
SC : Subject complement clause
OC : Object complement clause
QC : Quotative… See the full description on the dataset page: https://huggingface.co/datasets/SatyaH/jp-news-embedded-clause-corpus.embedded_faqs_medicareembedded_faqs_medicareembedded_faqs_medicareembedded_faqs_medicarewikipedia-22-12-en-nomic-embeddedembedded_faqs_medicareembedded_faqs_medicareembedded_faqs_medicareembedded_faqs_medicareembedded_faqs_medicareembedded_sg_faqembedded_faqs_medicareTTS_embeddedembedded_faqs_medicareembedded_faqs_medicareembedded_faqsembedded_faqs_medicareembedded-thingsembedded_dev
