datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
lily_controlnet_pose_dataset_version2_all_10812_ar_prepared_orisize_promptlistlily_controlnet_pose_dataset_1_8_people_10812_ar_prepared_orisize_promptlist_train_valstrategyqa-ret-robustDescriptive_Sentences_Helily_controlnet_pose_dataset_ar_prepared_1_2_orisize_promptlistlily_controlnet_pose_dataset_version2_all_10812_ar_prepared_orisize_promptlist2ori_standard_prompt_completion_rag
Ori Docs RAG — Standard Prompt-Completion
Q/A pairs generated from Ori documentation using a retrieval-augmented pipeline (OpenAI embeddings + GPT-4o) via LlamaIndex. Questions are specific to tasks/commands/steps; answers grounded in retrieved context.
Schema
Each row:
{
"prompt": "",
"completion": ""
}
Usage
from datasets import load_dataset
ds = load_dataset(adrianf12/ori_standard_prompt_completion_rag)
print(len(ds[train]))
print(ds[train][0])
lily_controlnet_pose_dataset_1_8_people_10812_ar_prepared_orisize_promptlist_w_1k_editslily_controlnet_pose_dataset_version2_all_10812_ar_prepared_orisize_promptlist2_train_vallily_controlnet_pose_dataset_1_8_people_10812_ar_prepared_orisize_promptlist_w_seglily_controlnet_pose_dataset_1_8_people_all_version2_all_10812_ar_prepared_orisize_promptlistlily_controlnet_pose_dataset_2_7_people_ar_prepared_orisize_promptlistlily_controlnet_pose_dataset_1_8_people_10812_ar_prepared_orisize_promptlist_w_seg_sample_100
