CoolFace
Modelpublic

second-state/OuteTTS-0.2-500M-GGUF

sourceHugging Facecc-by-nc-4.0updated 2y agoView on Hugging Face
1likes642downloads
Model Card

<!-- header start --> <!-- 200823 --> <div style="width: auto; margin-left: auto; margin-right: auto"> <img src="https://github.com/LlamaEdge/LlamaEdge/raw/dev/assets/logo.svg" style="width: 100%; min-width: 400px; display: block; margin: auto;"> </div> <hr style="margin-top: 1.0em; margin-bottom: 1.0em;"> <!-- header end -->

OuteTTS-0.2-500M-GGUF

Original Model

OuteAI/OuteTTS-0.2-500M

Run with LlamaEdge

  • Run as LlamaEdge service
bash
  wasmedge --dir .:. \
    --nn-preload tts:GGML:AUTO:OuteTTS-0.2-500M-Q5_K_M.gguf \
    llama-api-server.wasm config \
    --file llama_server_config.toml \
    --tts
  • llama_server_config.toml can be derived from the template config file llama_server_config.toml.bkp. The recommended [tts] config is shown as below
toml
    [tts]
    model_name   = "tts"            # Name of the TTS model.
    model_alias  = "tts"            # Alias of the TTS model.
    codec_model  = ""               # Required. Path to the codec model file.
    speaker_file  = ""              # Path to an alternative speaker file.
    ctx_size     = 8192             # Context size. Default is 8192.
    batch_size   = 8192             # Batch size. Default is 8192.
    ubatch_size  = 8192             # Physical maximum batch size. Default is 8192.
    n_predict    = 4096             # Number of tokens to predict. Default is 4096.
    n_gpu_layers = 100              # Number of layers to run on GPU. Default is 100.
    temp         = 0.8              # Temperature. Default is 0.8.

Quantized GGUF Models

NameQuant methodBitsSizeUse case
OuteTTS-0.2-500M-Q2_K.ggufQ2_K2344 MBsmallest, significant quality loss - not recommended for most purposes
OuteTTS-0.2-500M-Q3_K_L.ggufQ3KL3375 MBsmall, substantial quality loss
OuteTTS-0.2-500M-Q3_K_M.ggufQ3KM3361 MBvery small, high quality loss
OuteTTS-0.2-500M-Q3_K_S.ggufQ3KS3344 MBvery small, high quality loss
OuteTTS-0.2-500M-Q4_0.ggufQ4_04358 MBlegacy; small, very high quality loss - prefer using Q3KM
OuteTTS-0.2-500M-Q4_K_M.ggufQ4KM4403 MBmedium, balanced quality - recommended
OuteTTS-0.2-500M-Q4_K_S.ggufQ4KS4391 MBsmall, greater quality loss
OuteTTS-0.2-500M-Q5_0.ggufQ5_05402 MBlegacy; medium, balanced quality - prefer using Q4KM
OuteTTS-0.2-500M-Q5_K_M.ggufQ5KM5426 MBlarge, very low quality loss - recommended
OuteTTS-0.2-500M-Q5_K_S.ggufQ5KS5418 MBlarge, low quality loss - recommended
OuteTTS-0.2-500M-Q6_K.ggufQ6_K6511 MBvery large, extremely low quality loss
OuteTTS-0.2-500M-Q8_0.ggufQ8_08537 MBvery large, extremely low quality loss - not recommended
OuteTTS-0.2-500M-f16.gguff16161.00 GB
wavtokenizer-large-75-ggml-f16.gguff16161.00 GB

Quantized with llama.cpp b4381