models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Qwen3-ASR-1.7B-audio8-text4-mlxTextImageReference-to-Video-Audiowhisper-audio-to-textGemma3N-4B-Conv-MM-Img-Audio-Text-Code-Reasoning-Q8_0-GGUFGemma3N-4B-Conv-MM-Img-Audio-Text-HealthCare-Q8_0-GGUFWhisper-Sinhala_Audio_to_TextLongCat-AudioDiT-3.5B-tts-text-to-speech-SOTAtext-audio-classificationGemma3N-4B-Conv-MM-Img-Audio-Text-Code-Reasoningmt5-small-finetuned-audio-text-ccsaad-speech-recognition-hausa-audio-to-textt5-small-finetuned-audio-text-ccGemma3N-4B-Conv-MM-Img-Audio-Text-HealthCareLongCat-AudioDiT-3.5B-tts-text-to-speech-SOTASinhala_Audio_to_Text_CDAudioSangraha-Audio_to_TextSinhala-Audio_to_Textaudio-text-bertOneEncoder-text-image-audioqwen3-asr-1.7b-tq6_1s-text-tq4_1s-audioswahili_asr_audio_to_textImage_Audio_TextLongCat-AudioDiT-3.5B-tts-text-to-speech-SOTAaudio-to-texto-pt-brqwen3-asr-0.6b-tq6_1s-text-tq4_1s-audioqwen3-asr-forced-aligner-0.6b-tq4_1s-text-tq4_1s-audiomultimodal-popularity-classifier-video-text-audio-peft-robustAudioCourseU6-TextToSpeechAudioHateXplain_cascading_ASR-text_BERT-baseAudioHateXplain_cascading_Gold-text_BERT-base
