models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
SmolVLM2-256M-Video-Instruct-vision-W8A16-text-W4A16-G64Text_to_Visiontiny-random-VisionTextDualEncoderModel-vit-bertsd15.realistic_vision.v5_1.text_encoderSmolVLM2-500M-Video-Instruct-vision-BF16-text-W8A16-ASYMSmolVLM2-500M-Video-Instruct-vision-W8A16-text-W4A16-G64-ASYMEElayoutlmv3_jordyvl_rvl_cdip_100_examples_per_class_2023-08-12_text_vision_onlygemma-like-multimodal-speech-vision-textSmolVLM2-256M-Video-Instruct-vision-BF16-text-W8A16-ASYMEElayoutlmv3_jordyvl_rvl_cdip_100_examples_per_class_2023-08-23_text_vision_enc_9_10_11_12_rampSmolVLM2-256M-Video-Instruct-vision-BF16-text-W8A16-ASYM-dequant-bf16text2img_vision_2.0EElayoutlmv3_jordyvl_rvl_cdip_100_examples_per_class_2023-08-22_text_vision_enc_5_6_7_8_rampSmolVLM2-256M-Video-Instruct-vision-W8A16-text-W4A16-G64-dequant-bf16text2img_visiontext2img_vision_4.0vision-textileEElayoutlmv3_jordyvl_rvl_cdip_100_examples_per_class_2023-08-19_text_vision_all_encoders_rampthesis_halfsize_text1_vision0bestckpt_half_sized_text1_vision1qwen2-vl-nutritiontable-vision-text-v2-qlora-mergedSmolVLM2-256M-Video-Instruct-vision-W8A16-text-W4A16-G64-ASYMSmolVLM2-500M-Video-Instruct-vision-W8A16-text-W4A16-G64-ASYM-dequant-bf16EElayoutlmv3_jordyvl_rvl_cdip_100_examples_per_class_2023-08-21_text_vision_enc_1_2_3_4_rampthesis_halfsize_text1_vision1bestckpt_full_sized_text1_vision1bestckpt_full_sized_text10_vision0qwen2-vl-nutritiontable-vision-text-v2-qlora-merged2SmolVLM2-256M-Video-Instruct-vision-BF16-text-W8A16-ASYM-dequant-bf16tiny-random-VisionTextDualEncoderModel-vit-bert
