CoolFace
Datasetpublic

Alberto1231/databricks_dolly_15k

Databricks Dolly task samples Standalone task subsets derived from databricks/databricks-dolly-15k at revision bdd27f4d94b9c1f951818a7da7fd7aeea5dbff1a: general_qa (source category: general_qa) open_qa (source category: open_qa) closed_qa (source category: closed_qa) brainstorm (source category: brainstorming) classify (source category: classification) extract_information (source category: information_extraction) summarize (source category: summarization) creative_writing… See the full description on the dataset page: https://huggingface.co/datasets/Alberto1231/databricks_dolly_15k.

sourceHugging Facecc-by-sa-3.0updated 2mo agoView on Hugging Face
0likes117downloads
Dataset Card

Databricks Dolly task samples

Standalone task subsets derived from `databricks/databricks-dolly-15k` at revision bdd27f4d94b9c1f951818a7da7fd7aeea5dbff1a:

  • general_qa (source category: general_qa)
  • open_qa (source category: open_qa)
  • closed_qa (source category: closed_qa)
  • brainstorm (source category: brainstorming)
  • classify (source category: classification)
  • extract_information (source category: information_extraction)
  • summarize (source category: summarization)
  • creative_writing (source category: creative_writing)

Each subset contains exactly 100 rows sampled with seed 42: 5 rows in train for few-shot demonstrations and 95 disjoint rows in test.

When source context is present, it appears before the instruction:

text
Context:
<context>

Instruction:
<instruction>

Response:<SPACE>

The context section is omitted for rows without source context. The target is the original response written by a Databricks employee.