X-lord/Dataset-Text-To-Speech-Indonesia
π΅ Dataset Audio Bahasa Indonesia Dataset audio berkualitas tinggi untuk Text-to-Speech (TTS) bahasa Indonesia. Dibuat oleh : Muhammad Arief, S.Kom.Universitas Muhammadiyah SorongTeknik Informatika 2020 π Spesifikasi Teknis Parameter Nilai Satuan Total Durasi 16.38 jam Jumlah Segmen 4531 file Durasi Rata-rata 13.01 detik Sample Rate KHz 22 kHz Sample Rate Hz 22000 Hz Bit Depth PCM_16 PCM Format wav Lossless π Urutanβ¦ See the full description on the dataset page: https://huggingface.co/datasets/X-lord/Dataset-Text-To-Speech-Indonesia.
π΅ Dataset Audio Bahasa Indonesia
Dataset audio berkualitas tinggi untuk Text-to-Speech (TTS) bahasa Indonesia.
Dibuat oleh : \ Muhammad Arief, S.Kom.\ Universitas Muhammadiyah Sorong\ Teknik Informatika 2020
π Spesifikasi Teknis
π Urutan Pengolahan Data
- π File Loading - Mengumpulkan file audio
- π RMS Analysis - Analisis Root Mean Square untuk deteksi silence
- ποΈ RVC Algorithm - Penerapan algoritma RVC untuk segmentasi audio
- βοΈ Auto Slicing - Pemotongan otomatis berdasarkan threshold silence
- π Duration Optimization - Penyesuaian panjang segment ke rata-rata optimal
- π Audio Resampling - Konversi sample rate ke 22kHz (standar)
- π€ Whisper AI - Transkripsi menggunakan model Whisper
- π Metadata Assembly - Penyusunan metadata dan transkripsi
- π€ Dataset Conversion - Konversi ke format Hugging Face Dataset
- π€ Cloud Deployment - Upload ke Hugging Face Hub
Tahun pembuatan: 2026
βοΈ Etika & Lisensi
- Lisensi: MIT
- Tidak mengandung data pribadi
- Proses terstandarisasi & reproducible
Dataset Name: X-lord/Dataset-Text-To-Speech-Indonesia Created: 2026-01-11 19:38:08
