datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
olm-CC-MAIN-2022-40-sampling-ratio-0.15894621295-perplexity-filters
Dataset Card for "olm-CC-MAIN-2022-40-sampling-ratio-0.15894621295-perplexity-filters"
More Information needed
hc3-and-gpt-wiki-intro-with-perplexity-and-32-windowdyck-perplexitywikitext-2-raw-v1-preprocessed-200-PP_RIP_PTP_-wikipedia-dpr-k-1-OP-False-train-perplexitywikitext-2-raw-v1-preprocessed-200-PP_RIP_PTP_-wikipedia-dpr-k-2-OP-False-train-perplexityhc3-and-gpt-wiki-intro-with-perplexity
Dataset Card for "hc3-and-gpt-wiki-intro-with-perplexity"
More Information needed
hc2-wiki-perplexity-stride-32-maxlen-128wikitext-2-raw-v1-preprocessed-200-PP_RIP_PTP_-wikipedia-dpr-k-2-OP-True-train-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-2-OP-True-train-perplexityhc3-and-gpt-wiki-intro-with-perplexity-and-128-windowexperiment_perplexity_instruction_llama3_8b_responsewikitext-2-raw-v1-preprocessed-200-PI_KFI-FK_claude-train-PI_KFI_IK-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-1-OP-False-train-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI-FK_-train-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-2-OP-False-train-PI_KFI-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-2-OP-False-train-perplexitytest-dpo-perplexity
test-dpo-perplexity
This DPO (Direct Preference Optimization) dataset was generated using watermarked text generation
with red/blue token parity sampling. Each prompt has both a red and blue answer for creating
preference pairs.
Watermark Configuration
Sampler Type: soft_watermark
Soft Mode: True
Soft Threshold: 0.95
Sampling Parameters
Temperature: 0.7
Top-p: 0.8
Top-k: 20
Max Tokens: 64
Statistics
Total Prompts: 3
Avg Red Parity Ratio: 0.5521… See the full description on the dataset page: https://huggingface.co/datasets/eac123/test-dpo-perplexity.wikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-1-OP-True-train-PI_KFI-perplexitywikitext-2-raw-v1-preprocessed-200-PP_RIP_PTP-train-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-2-OP-True-train-PI_KFI-perplexityexperiment_perplexity_instructionwikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-2-OP-False-train-PI_KFI_IK-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-1-OP-True-train-PI_KFI_IK-perplexitywikitext-2-raw-v1-preprocessed-200-PP_RIP_PTP-train-PP_RIP_PTP-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-1-OP-False-train-PI_KFI_IK-perplexityhc3-wiki-perplexity-stride-32-maxlen-256wikitext-2-raw-v1-preprocessed-200-PP_RIP_PTP-train-PP_RIP_PTP_IK-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-1-OP-True-train-perplexitywikitext-2-raw-v1-preprocessed-200-PI_KFI_-wikipedia-dpr-k-2-OP-True-train-PI_KFI_IK-perplexitywikitext-2-raw-v1-preprocessed-200-PP_RIP_PTP_-wikipedia-dpr-k-1-OP-True-train-perplexity
