models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
pythia-1.4b-sampling-watermark-distill-kgw-k1-gamma0.25-delta2pythia-1.4b-sampling-watermark-distill-kgw-k0-gamma0.25-delta2pythia-1.4b-sampling-watermark-distill-kgw-k1-gamma0.25-delta1pythia-1.4b-sampling-watermark-distill-aar-k2pythia-1.4b-sampling-watermark-distill-kth-shift1pythia-1.4b-sampling-watermark-distill-kth-shift2pythia-1.4b-sampling-watermark-distill-kth-shift4pythia-1.4b-sampling-watermark-distill-kgw-k2-gamma0.25-delta2pythia-1.4b-sampling-watermark-distill-aar-k3pythia-1.4b-sampling-watermark-distill-kth-shift256cygu-llama-2-7b-sampling-watermark-distill-kth-shift256-ft-learnability_advlm-1.3B-select_30B_tokens_by-uniform-samplingLM-1b_1x-Sampling_over_Topics_for_HellaSwagllama-2-7b-sampling-watermark-distill-kth-shift256pythia-1.4b-sampling-watermark-distill-aar-k4pythia-1.4b-sampling-watermark-distill-kgw-k0-gamma0.25-delta1llama-2-7b-sampling-watermark-distill-aar-k3LM-1b_1x-Sampling_over_Topics_x_Formats_for_MMLU_and_HellaswagUnifiedReward-Think-rejection_sampling_wholelm-1.3B-select_30B_tokens_by-uniform-sampling-curriculum-high_to_low-required_expertisegpt2-cl-length-samplingLM-1b_1x-Sampling_over_Formats_for_HellaSwagsampling_with_kvcachellama-2-7b-sampling-watermark-distill-kgw-k0-gamma0.25-delta2lm-1.3B-select_30B_tokens_by-uniform-sampling-curriculum-low_to_high-required_expertiseLM-1b_1x-Sampling_over_Topics_for_MMLULM-1b_1x-Sampling_over_KMeans_for_HellaSwagLM-1b_1x-Sampling_over_Topics_x_Formats_for_HellaSwagLM-1b_1x-Sampling_over_KMeans_for_MMLU_and_HellaSwagLlama-2-7b-chat-hf-science-rejection-sampling
