Alberto1231/databricks_dolly_15k
Databricks Dolly task samples Standalone task subsets derived from databricks/databricks-dolly-15k at revision bdd27f4d94b9c1f951818a7da7fd7aeea5dbff1a: general_qa (source category: general_qa) open_qa (source category: open_qa) closed_qa (source category: closed_qa) brainstorm (source category: brainstorming) classify (source category: classification) extract_information (source category: information_extraction) summarize (source category: summarization) creative_writing… See the full description on the dataset page: https://huggingface.co/datasets/Alberto1231/databricks_dolly_15k.
Databricks Dolly task samples
Standalone task subsets derived from `databricks/databricks-dolly-15k` at revision bdd27f4d94b9c1f951818a7da7fd7aeea5dbff1a:
general_qa(source category:general_qa)open_qa(source category:open_qa)closed_qa(source category:closed_qa)brainstorm(source category:brainstorming)classify(source category:classification)extract_information(source category:information_extraction)summarize(source category:summarization)creative_writing(source category:creative_writing)
Each subset contains exactly 100 rows sampled with seed 42: 5 rows in train for few-shot demonstrations and 95 disjoint rows in test.
When source context is present, it appears before the instruction:
Context:
<context>
Instruction:
<instruction>
Response:<SPACE>The context section is omitted for rows without source context. The target is the original response written by a Databricks employee.
