Coar231/tfgridnet-demo
0
๐ค TF-GridNet Speech Enhancement Demo
Real-time speech enhancement powered by TF-GridNet deep learning model.
Features
- ๐ต Upload audio files (WAV, MP3, FLAC, OGG)
- ๐ค Record audio directly from microphone
- โจ Real-time speech enhancement
- ๐ Performance metrics (latency, RTF)
- ๐ Waveform visualization
- โฌ๏ธ Download enhanced audio
Model Info
- Architecture: TF-GridNet
- Sample Rate: 8kHz
- Parameters: 2.3M
- Tasks: Speech Enhancement, Separation, Denoising, Dereverberation
Usage
- Upload an audio file or record from microphone
- Click "๐ Enhance Audio" button
- Listen to the enhanced result
- Download the improved audio
Technical Details
The model uses TF-GridNet architecture with:
- STFT window size: 128
- LSTM hidden units: 128
- Attention heads: 4
- 3 processing layers
Built with Streamlit and PyTorch.
