models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Qwen3-ASR-1.7B-audio8-text4-mlxTextImageReference-to-Video-Audiowhisper-audio-to-textGemma3N-4B-Conv-MM-Img-Audio-Text-Code-Reasoning-Q8_0-GGUFLongCat-AudioDiT-3.5B-tts-text-to-speech-SOTAGemma3N-4B-Conv-MM-Img-Audio-Text-HealthCare-Q8_0-GGUFWhisper-Sinhala_Audio_to_Texttext-audio-classificationGemma3N-4B-Conv-MM-Img-Audio-Text-Code-Reasoningmt5-small-finetuned-audio-text-ccsaad-speech-recognition-hausa-audio-to-textt5-small-finetuned-audio-text-ccSinhala_Audio_to_Text_CDGemma3N-4B-Conv-MM-Img-Audio-Text-HealthCareAudioSangraha-Audio_to_TextSinhala-Audio_to_Textmultimodal-popularity-classifier-video-text-audio-peft-robustswahili_asr_audio_to_textaudio-text-bertImage_Audio_TextLongCat-AudioDiT-3.5B-tts-text-to-speech-SOTAOneEncoder-text-image-audioSpeechCOMET-textaudioqwen3-asr-1.7b-tq6_1s-text-tq4_1s-audioqwen3-asr-forced-aligner-0.6b-tq4_1s-text-tq4_1s-audioLongCat-AudioDiT-3.5B-tts-text-to-speech-SOTAAudioCourseU6-TextToSpeechmultimodal-popularity-classifier-video-text-audio-peftqwen3-asr-0.6b-tq6_1s-text-tq4_1s-audioaudio-to-texto-pt-br
