datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
PersonalizationV3PersonalizationV4PG-Personalization-Amazon2023PersonalizationV3PersonalizationV3PersonalizationPersonalization_DatabasePersonalizationV2personalization-reddit-multiturn
personalization-reddit-multiturn
Multi-turn (question, preferred_answer, full_conversation) records mined
from Reddit. Companion to dipikakhullar/personalization-reddit: same
OP-thanks-reply heuristic for identifying the preferred answerer, but
this dataset additionally captures any contiguous back-and-forth between
the OP and that single answerer after the thanks.
A record is only emitted when there is at least one further turn beyond
the OP's thanks reply.
Splits… See the full description on the dataset page: https://huggingface.co/datasets/dipikakhullar/personalization-reddit-multiturn.personalization-agentic-rag-10docs-generationspersonalization_prompt_response_euruspersonalization_prompt_response_oasst_pythia_1bPersonalization_Benchpersonalization-agentic-rag-5docs-generationspersonalization_prompt_response_gemma_2bpersonalization-agentic-rag-3docs-generationspersonalization_prompt_response_mistral_raftpersonalization_prompt_response_oasst_pythia_7btrait-vectorspersonalization_prompt_response_llama3_sfairxpersonalization_prompt_response_starling_34BPersonalization_Bench_w_dpapersonalization_prompt_response_mistralpersonalization_prompt_response_mistral_weqweasdaspersonalization_prompt_response_mistral_raypersonalization_prompt_response_gemma_7bpersonalization_prompt_response_mistral_dpapersonalization_prompt_response_ziya_llama_7bpersonalization_prompt_response_oasst_deberta_v3_oldpersonalization_prompt_response_beaver_7b
