CoolFace
Apppublic

Coar231/tfgridnet-demo

sourceHugging Faceupdated 10mo agoView on Hugging Face
0likes
App README

๐ŸŽค TF-GridNet Speech Enhancement Demo

Real-time speech enhancement powered by TF-GridNet deep learning model.

Features

  • โ€”๐ŸŽต Upload audio files (WAV, MP3, FLAC, OGG)
  • โ€”๐ŸŽค Record audio directly from microphone
  • โ€”โœจ Real-time speech enhancement
  • โ€”๐Ÿ“Š Performance metrics (latency, RTF)
  • โ€”๐Ÿ“‰ Waveform visualization
  • โ€”โฌ‡๏ธ Download enhanced audio

Model Info

  • โ€”Architecture: TF-GridNet
  • โ€”Sample Rate: 8kHz
  • โ€”Parameters: 2.3M
  • โ€”Tasks: Speech Enhancement, Separation, Denoising, Dereverberation

Usage

  1. 1.Upload an audio file or record from microphone
  2. 2.Click "๐Ÿš€ Enhance Audio" button
  3. 3.Listen to the enhanced result
  4. 4.Download the improved audio

Technical Details

The model uses TF-GridNet architecture with:

  • โ€”STFT window size: 128
  • โ€”LSTM hidden units: 128
  • โ€”Attention heads: 4
  • โ€”3 processing layers

Built with Streamlit and PyTorch.