mispeech/dashengtokenizer
141.2k
1{2 "architectures": [3 "DashengTokenizerModel"4 ],5 "auto_map": {6 "AutoConfig": "configuration_dasheng_tokenizer.DashengTokenizerConfig",7 "AutoModel": "modeling_dasheng_tokenizer.DashengTokenizerModel"8 },9 "decoder_depth": 12,10 "decoder_embed_dim": 1280,11 "decoder_intermediate_size": 5120,12 "depth": 32,13 "dtype": "float32",14 "embed_dim": 1280,15 "hop_length": 160,16 "istft_hop": 320,17 "istft_n_fft": 1280,18 "model_type": "dashengtokenizer",19 "n_mels_patch": 128,20 "num_heads": 16,21 "transformers_version": "5.1.0",22 "upsample_tokens": 223}