CoolFace
Datasetpublic

teticio/audio-diffusion-1024

Over 20,000 256x256 mel spectrograms of 5 second samples of music from my Spotify liked playlist. The code to convert from audio to spectrogram and vice versa can be found in https://github.com/teticio/audio-diffusion along with scripts to train and run inference using De-noising Diffusion Probabilistic Models. x_res = 1024 y_res = 1024 sample_rate = 44100 n_fft = 2048 hop_length = 512

sourceHugging Faceupdated 4y agoView on Hugging Face
0likes328downloads
../
filetrain-00000-of-00011-6f8e27f44fe5ff60.parquet434.6 MBdownload
filetrain-00001-of-00011-ee5c88e8195babe8.parquet431.8 MBdownload
filetrain-00002-of-00011-270a72434265ba80.parquet431.4 MBdownload
filetrain-00003-of-00011-e29419c4b9ac212f.parquet428.6 MBdownload
filetrain-00004-of-00011-1ff92f5c245f9a1b.parquet436.4 MBdownload
filetrain-00005-of-00011-f789c3dadd0b4b0a.parquet430.5 MBdownload
filetrain-00006-of-00011-bbc16208d877a8f8.parquet439.3 MBdownload
filetrain-00007-of-00011-3938b3216cccec8a.parquet437.9 MBdownload
filetrain-00008-of-00011-91fa9da0c3031b34.parquet429.6 MBdownload
filetrain-00009-of-00011-e932292491a1d71c.parquet435.5 MBdownload
filetrain-00010-of-00011-23865b6de3756278.parquet433.2 MBdownload

teticio/audio-diffusion-1024 · main · files are served by the source, never re-hosted here