teticio/audio-diffusion-1024
Over 20,000 256x256 mel spectrograms of 5 second samples of music from my Spotify liked playlist. The code to convert from audio to spectrogram and vice versa can be found in https://github.com/teticio/audio-diffusion along with scripts to train and run inference using De-noising Diffusion Probabilistic Models. x_res = 1024 y_res = 1024 sample_rate = 44100 n_fft = 2048 hop_length = 512
0328
../
train-00000-of-00011-6f8e27f44fe5ff60.parquetdownload
train-00001-of-00011-ee5c88e8195babe8.parquetdownload
train-00002-of-00011-270a72434265ba80.parquetdownload
train-00003-of-00011-e29419c4b9ac212f.parquetdownload
train-00004-of-00011-1ff92f5c245f9a1b.parquetdownload
train-00005-of-00011-f789c3dadd0b4b0a.parquetdownload
train-00006-of-00011-bbc16208d877a8f8.parquetdownload
train-00007-of-00011-3938b3216cccec8a.parquetdownload
train-00008-of-00011-91fa9da0c3031b34.parquetdownload
train-00009-of-00011-e932292491a1d71c.parquetdownload
train-00010-of-00011-23865b6de3756278.parquetdownload
