dipit099/bengali-tts-yt-test
Bengali TTS — YouTube Pipeline (test) YouTube-sourced Bengali speech chunks transcribed with Gemini 2.5 Flash, produced by the YT scraping + VAD chunking + Gemini transcription pipeline. Columns Column Description uuid Unique identifier (<video_id>_<chunk#>) speaker Speaker / channel name video_id YouTube video ID chunk_file Chunk filename audio_file <speaker>_<video_id>_<chunk_file> duration Duration in seconds transcription Gemini… See the full description on the dataset page: https://huggingface.co/datasets/dipit099/bengali-tts-yt-test.
Upload data/train-keep_00196.parquet with huggingface_hub
Upload data/train-keep_00195.parquet with huggingface_hub
Upload data/train-keep_00170.parquet with huggingface_hub
Upload data/train-keep_00200.parquet with huggingface_hub
Upload data/train-keep_00180.parquet with huggingface_hub
Upload data/train-keep_00175.parquet with huggingface_hub
Upload data/train-keep_00166.parquet with huggingface_hub
delete it
Upload data/train-keep_00170.parquet with huggingface_hub
Upload data/train-keep_00165.parquet with huggingface_hub
final done
Upload data/train-keep_00166.parquet with huggingface_hub
Upload data/train-keep_00165.parquet with huggingface_hub
restarting
Upload README.md with huggingface_hub
done
Create README.md
Upload data/train-00000.parquet with huggingface_hub
initial commit
