CoolFace
Datasetpublic

LeeHarrold/musiccaps-mot-tokens

MusicCaps Pre-Encoded Tokens for Mixture-of-Transformers (MoT) Dataset Description This dataset contains pre-encoded audio tokens from the MusicCaps dataset, processed through Meta's MusicGen EnCodec tokenizer for use in Mixture-of-Transformers (MoT) training. Dataset Summary 5,233 music clips encoded as discrete tokens 4 codebook layers from MusicGen's EnCodec ~500 tokens per 10-second clip Compressed from ~12GB audio to 82MB tokens Ready for… See the full description on the dataset page: https://huggingface.co/datasets/LeeHarrold/musiccaps-mot-tokens.

sourceHugging Faceupdated 10mo agoView on Hugging Face
0likes23downloads
5 commits on main
cab4f0c10mo ago

Upload README.md with huggingface_hub

LeeHarrold
c2e317510mo ago

Upload dataset

LeeHarrold
84b758210mo ago

Upload README.md with huggingface_hub

LeeHarrold
646e62210mo ago

Upload dataset

LeeHarrold
4d3382410mo ago

initial commit

LeeHarrold