CoolFace
Datasetpublic

Alvor/audio-tokenizer-demo

Audio Tokenizer Demo Dataset Audio samples processed by various neural audio tokenizers for comparison. Tokenizers Column Tokens/sec Codebooks cosyvoice2 25 1 glm4voice 12.5 1 mimoaudio 6.25 8 neucodec 50 1 wavtokenizer 40 1 xcodec2 50 1 unicodec 75 1 bicodec 50 1 (Semantic) + 1 (Global Fixed 35 tokens) flexicodec <100 1(FSQ)+7(RVQ) varstok <40 1 MOSS 400 32 H-Codec-1.5 <200 4(Acoustic) + 4(Semantic)

sourceHugging Faceupdated 7mo agoView on Hugging Face
0likes132downloads
Dataset Card

Audio Tokenizer Demo Dataset

Audio samples processed by various neural audio tokenizers for comparison.

Tokenizers

ColumnTokens/secCodebooks
cosyvoice2251
glm4voice12.51
mimoaudio6.258
neucodec501
wavtokenizer401
xcodec2501
unicodec751
bicodec501 (Semantic) + 1 (Global Fixed 35 tokens)
flexicodec<1001(FSQ)+7(RVQ)
varstok<401
MOSS40032
H-Codec-1.5<2004(Acoustic) + 4(Semantic)