position-bias
shakespeare-bias-per-positionbias-experiment-per-positionLlama-3.2-1B_3_mix_position_biased_unbiasedLlama-3.2-3B_3_mix_position_biased_unbiaseddpo_thinking_reddit_judge_position_bias_1e-6_0.02_4B_4Bgrpo_reddit_judge_position_bias_64_8_3e-5_1e-6_4Bdpo_thinking_reddit_judge_position_bias_extra_1e-6_0.02_4B_4Bgrpo_reddit_judge_position_bias_16_64_8_3e-5_1e-6_1.7B
position-bias-training-datasets
Position-Bias Training Datasets (main 4 distributions)
Synthetic retrieval training data used to induce/control position bias in embedding
models, restricted to the four main evidence-position distributions used in the paper.
Filtered at reranker threshold t030 (signal_gap ≥ 0.30, highest label purity).
Each example is a (question, positive_doc) pair. The distributions differ only in where
the relevant evidence sits inside the positive document (beginning / middle / end),
mixed… See the full description on the dataset page: https://huggingface.co/datasets/sionic-ai/position-bias-training-datasets.ALCUNA_meta_affirmative_3_mix_position_biased_unbiasedALCUNA_meta_affirmative_3_mix_position_biased_unbiased_train
