models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
RoBERTa-large-SizeCorpus_1Blongformer-base-4096-text-classification-imdb-adamw-att_win_size_32bert_regression_basic_16_batch_sizet5-base_cola_dense_epochs-6_exp_size_4cpm.hi.bert-base-uncased.layer.10.size.192t5-base_cola_mare_ar345_ex39_size-4_epochs-6_exp_size_4_mare_mlpcpm.hi.roberta-base.layer.8.size.192t5-base_cola_mare_ar16_ex0_size-32_epochs-5_collected-statst5-base_cola_mare_ar48_ex48_size-16_epochs-8_with_distillation_mare_mlpcpm.hi.gpt2.layer.12.size.192t5-base_cola_mare_ar2_ex16_size-64_collected-statscpm.hi.lstm.layer.1.size.64roberta-large-finetuned-mnli-batch_size_4_100000_samplesno_global_attention_longformer-base-512-text-classification-emotion-adam-att_win_size_64t5-base_cola_mare_ar9_ex10_size-16_epochs-5_mare_mlpt5-base_cola_mare_ar14_ex5_size-16_epochs-5_mare_mlpt5-base_cola_mare_ar34_ex4_size-16_epochs-5_mare_mlpt5-base_cola_mare_ar48_ex48_size-16_epochs-5_mare_mlpt5-base_cola_mare_ar19_ex0_size-16_epochs-3_decoder_all_sparsity10_mare_mlpt5-base_cola_mare_ar19_ex19_size-16_epochs-2_decoder_all_sparsity10_mare_mlplongformer-base-512-text-classification-emotion-adamw-att_win_size_512-epochs-7longformer-base-512-text-classification-emotion-adam-att_win_size_128longformer-base-512-text-classification-emotion-adam-att_win_size_512no_global_attention_longformer-base-512-text-classification-emotion-sgd-att_win_size_128no_global_attention_longformer-base-512-text-classification-imdb-sgd-att_win_size_32t5-base_cola_mare_ar24_ex72_size-16_epochs-5_mare_mlpt5-base_cola_mare_ar72_ex24_size-16_epochs-5_mare_mlpt5-base_cola_mare_ar48_ex48_size-16_epochs-6_exp_size_16_mare_mlpt5-base_cola_mare_ar72_ex24_size-16_epochs-8_with_distillation_50_with_softmax_mare_mlpt5-base_cola_mare_ar9_ex29_size-16_epochs-3_decoder_all_sparsity20_mare_mlp
