z050209/va-spoken-qa-agentvoice-stage2
Stage-2 spoken-QA training corpus (gemma4_talker) 97,697 train / 935 val spoken QA pairs. Questions: REAL user audio from VoiceAssistant-400K (audio_q.*.tar, filenames match input_audio basenames in the manifests). Answers: synthesized in ONE fixed agent voice (LibriSpeech train-clean-100 narrator ref via ResembleAI/Chatterbox; audio_a.*.tar matching assistant_audio). Manifests carry transcripts, answer text, and GLM-4-Voice speech tokens for both sides (glm_in_tokens question /… See the full description on the dataset page: https://huggingface.co/datasets/z050209/va-spoken-qa-agentvoice-stage2.
add audio_q.009.tar
add audio_q.008.tar
add audio_q.005.tar
add audio_q.004.tar
add audio_q.002.tar
add audio_q.001.tar
add audio_q.000.tar
add audio_a.033.tar
add audio_a.029.tar
add audio_a.028.tar
add audio_a.027.tar
add audio_a.025.tar
add audio_a.024.tar
add audio_a.021.tar
add audio_a.020.tar
add audio_a.019.tar
add audio_a.018.tar
add audio_a.016.tar
add audio_a.015.tar
add audio_a.013.tar
add audio_a.012.tar
add audio_a.010.tar
add audio_a.009.tar
add audio_a.008.tar
add audio_a.007.tar
add audio_a.006.tar
add audio_a.004.tar
add audio_a.000.tar
Add files using upload-large-folder tool
initial commit
