CoolFace
Modelpublic

msaligs/ast_fine_tuned_music_genre_10

sourceHugging Facemitupdated 6mo agoView on Hugging Face
1likes17downloads
Model Card

๐ŸŽต Music Genre Classification using AST

๐Ÿ“Œ Model Overview

This model is a fine-tuned Audio Spectrogram Transformer (AST) for music genre classification.

It predicts one of the following 10 genres:

  • โ€”blues, classical, country, disco, hiphop
  • โ€”jazz, metal, pop, reggae, rock

๐Ÿง  Architecture

  • โ€”Base Model: MIT/ast-finetuned-audioset
  • โ€”Type: Transformer (Audio Spectrogram Transformer)
  • โ€”Framework: PyTorch + Hugging Face Transformers

๐ŸŽฏ Task

Audio Classification (Music Genre Classification)


๐Ÿ“Š Dataset

  • โ€”Training Data: Clean instrument stems (drums, vocals, bass, others)
  • โ€”Test Data: Noisy mashups with:
  • โ€”cross-song mixing
  • โ€”tempo variation
  • โ€”ESC-50 noise injection

โš™๏ธ Preprocessing

  • โ€”Sampling rate: 16kHz
  • โ€”Fixed duration: 15 seconds
  • โ€”Padding / truncation applied
  • โ€”Feature extraction using ASTFeatureExtractor

๐Ÿ“ˆ Performance

  • โ€”Metric: Macro F1 Score
  • โ€”Achieved: 0.87

๐Ÿ”— Live Demo

Try the model here: ๐Ÿ‘‰ https://huggingface.co/spaces/msaligs/music-genre-classifier

๐Ÿš€ Usage

python
from transformers import ASTForAudioClassification, ASTFeatureExtractor

model = ASTForAudioClassification.from_pretrained("msaligs/ast_fine_tuned_music_genre_10")
feature_extractor = ASTFeatureExtractor.from_pretrained("msaligs/ast_fine_tuned_music_genre_10")