models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Qwen-2.5-7B-AdamW-RL-i1-GGUFAdamW_130m-GGUFQwen-2.5-7B-AdamW-RL-GGUFds_chat_reflection_adamw_iter1-GGUFqwen2_chat_adamw_iter2-GGUFlora_Qwen3_0.6B_model_q4_k_m_adamw_8bit.ggufadamw_8bitadamw-model-testHebrewGPT-1B-AdamW7b-m-dans-optimizersweeps-repremover-1-adamw-GGUFconvergent-mamba2-300M-adamw-originalv53_Large_AdaMWv54_Large_AdaMWSalesforce-codet5-small-CodeXGLUE-CONCODE-adamwnanochat-adamWbatch1_epochs1_lr1e-05_paged_adamw_32bit_cosine_length2048_warmup_0.05_max_grad1.0_grad_accu32sweep-nep-sft_ministral-3-3b_lora_r32_lr2e-4_wd0.01_adamw-8bit_linearcommonsense-adamw-seed0fwe-1b-adamw-step100000ALE-GPT-llama2-7B-1562-int8-lora256-constant-adamw8bitadamwathanbatch1_epochs4_lr1e-05_paged_adamw_32bit_cosine_length2048_warmup_0.05_max_grad1.0_grad_accu16distilgpt2-finetuned-wikitext2batch1_epochs4_lr1e-05_paged_adamw_32bit_cosine_len2048_warm0.05_grad1.0_accu16_neft5longformer-base-4096-text-classification-imdb-adamw-att_win_size_32HumanAssistanceResults_8_CAUSAL_LM_tbs2_lr0.0002_optimpaged_adamw_32bitconvergent-gdn-300M-adamw-originalQwen2.5-0.5B_adamw_v2batch1_epochs4_lr1e-05_paged_adamw_32bit_cosine_length2048_warmup_0.05_max_grad1.0_grad_accu32batch1_epochs4_lr1e-05_paged_adamw_32bit_cosine_len2048_warm0.05_grad1.0_accu10_neft5
