k9cli/video-vec2wav2-tokenizer
video-vec2wav2-tokenizer Production-ready pipeline (Python package video_vec2wav2_tokenizer, CLI command video2dataset) that turns a folder of videos into clean AI training datasets for speech recognition (ASR) and text-to-speech (TTS). videos ──► audio (16 kHz mono PCM) ──► whisper transcript ──► clips ──► metadata.csv / dataset.jsonl / tts_metadata.csv / report.json Video processing — recursive scan of mp4 / mkv / avi / mov / webm, FFmpeg audio extraction to mono ·… See the full description on the dataset page: https://huggingface.co/datasets/k9cli/video-vec2wav2-tokenizer.
Add dataset/W101WaVjOAtqY2 (402 parts) (part 2)
Add dataset/W101WaVjOAtqY2 (402 parts)
Add dataset/RpbOdqQM0RcdGmP (427 parts) (part 2)
Add dataset/RpbOdqQM0RcdGmP (427 parts)
Add dataset/DPzLV7ZKBMsk0zX (414 parts) (part 2)
Add dataset/DPzLV7ZKBMsk0zX (414 parts)
Add dataset/8wJ8MBGVpXc6D2 (385 parts) (part 2)
Add dataset/8wJ8MBGVpXc6D2 (385 parts)
Add dataset/QdLpMdmDvlckkv (392 parts) (part 2)
Add dataset/QdLpMdmDvlckkv (392 parts)
Add dataset/gYYRRGdJwKcqA21 (421 parts) (part 2)
Add dataset/gYYRRGdJwKcqA21 (421 parts)
Add dataset/qKVXxv69z2FLkK (411 parts) (part 2)
Add dataset/qKVXxv69z2FLkK (411 parts)
Add dataset/MYrdvadyeksmjxW (356 parts) (part 2)
Add dataset/MYrdvadyeksmjxW (356 parts)
Add dataset/vpO722q3rJT49wJ (354 parts) (part 2)
Add dataset/vpO722q3rJT49wJ (354 parts)
Add dataset/4xdJpQReMoUKalb (368 parts) (part 2)
Add dataset/4xdJpQReMoUKalb (368 parts)
Add dataset/O4BRowKxx9iZp46 (354 parts) (part 2)
Add dataset/O4BRowKxx9iZp46 (354 parts)
Add dataset/3VoDleyLAgTdVQj (353 parts) (part 2)
Add dataset/3VoDleyLAgTdVQj (353 parts)
Add dataset/16L6BMXwQ6HeZ92 (372 parts) (part 2)
Add dataset/16L6BMXwQ6HeZ92 (372 parts)
Add dataset/dVrmjVypLvfZ0e (375 parts) (part 2)
Add dataset/dVrmjVypLvfZ0e (375 parts)
Add dataset/g9vOq4ZaeyTJp3 (360 parts) (part 2)
Add dataset/g9vOq4ZaeyTJp3 (360 parts)
Add dataset/ZjGKga8ldLsqqwQ (365 parts) (part 2)
Add dataset/ZjGKga8ldLsqqwQ (365 parts)
Add dataset/meoQVVdowMibgZB (396 parts) (part 2)
Add dataset/meoQVVdowMibgZB (396 parts)
Add dataset/KGQ6ddPaqKu0Mkp (366 parts) (part 2)
Add dataset/KGQ6ddPaqKu0Mkp (366 parts)
Add dataset/VaZ4kbWzJbtykP (356 parts) (part 2)
Add dataset/VaZ4kbWzJbtykP (356 parts)
Add dataset/D0BxXd3lVyukgzo (344 parts) (part 2)
Add dataset/D0BxXd3lVyukgzo (344 parts)
Add dataset/lAVMxVoGDoSmBZ (348 parts) (part 2)
Add dataset/lAVMxVoGDoSmBZ (348 parts)
Add dataset/mOgxkp18ZYTbLyD (356 parts) (part 2)
Add dataset/mOgxkp18ZYTbLyD (356 parts)
Add dataset/Dz7kX7X7dqukyp1 (342 parts) (part 2)
Add dataset/Dz7kX7X7dqukyp1 (342 parts)
Add dataset/PDzRdrZQXWC07WD (350 parts) (part 2)
Add dataset/PDzRdrZQXWC07WD (350 parts)
Add dataset/PvqOzw9Q0zTb7G (348 parts) (part 2)
Add dataset/PvqOzw9Q0zTb7G (348 parts)
