multi-stream
multitalker-parakeet-streaming-0.6b-v1-ggufstt_en_fastconformer_hybrid_large_streaming_multimultitalker-parakeet-streaming-0.6b-v1Nemotron-3.5-ASR-Streaming-Multilingual-0.6b-CoreMLNemotron-3.5-ASR-Streaming-Multilingual-0.6B-ONNX-FP16Nemotron-3.5-ASR-Streaming-Multilingual-0.6B-LiteRT-INT8nemotron-3.5-asr-streaming-multilingual-0.6b-litert-fp16Nemotron-3.5-ASR-Streaming-Multilingual-0.6B-LiteRT-FP16
multi-stream-spontaneous-conversation-training-datasets_chinese
Multi-stream Spontaneous Conversation Training Datasets_Chinese
Every data point counts.
Dataset Basic Info
Dataset Type: ASR Corpus
Language: Chinese
Audio Parameters: 16 kHz, 16 bits
File Format: WAV (PCM)
Recording Equipment: Mobile device
Dataset Description
The Multi-stream conversation dataset developed by MagicData captures each speaker's audio track and labels each speaker separately, thereby preserving the natural occurrences of… See the full description on the dataset page: https://huggingface.co/datasets/MagicHub/multi-stream-spontaneous-conversation-training-datasets_chinese.multi-stream-spontaneous-conversation-training-datasets_chinese
Multi-stream Spontaneous Conversation Training Datasets_Chinese
Every data point counts.
Dataset Basic Info
Dataset Type: ASR Corpus
Language: Chinese
Audio Parameters: 16 kHz, 16 bits
File Format: WAV (PCM)
Recording Equipment: Mobile device
Dataset Description
The Multi-stream conversation dataset developed by MagicData captures each speaker's audio track and labels each speaker separately, thereby preserving the natural occurrences of… See the full description on the dataset page: https://huggingface.co/datasets/MagicDataTech/multi-stream-spontaneous-conversation-training-datasets_chinese.multi-stream-spontaneous-conversation-training-datasets_english
Multi-stream Spontaneous Conversation Training Datasets_English
Every data point counts.
Dataset Basic Info
Dataset Type: ASR Corpus
Language: English
Audio Parameters: 16 kHz, 16 bits
File Format: WAV (PCM)
Recording Equipment: Mobile device
Dataset Description
The Multi-stream conversation dataset developed by MagicData captures each speaker's audio track and labels each speaker separately, thereby preserving the natural occurrences of… See the full description on the dataset page: https://huggingface.co/datasets/MagicHub/multi-stream-spontaneous-conversation-training-datasets_english.Chinese_Female_Speech_Synthesis_Corpus_Live_Streaming_for_Sales_with_Multi_Styles
ID
King-TTS-241
Duration
8.56 hours
Speakers
100 People
Labeling Details
Pronunciation, Rhythm, Breath sounds marked with {hx}
Language
Chinese
Description
Two styles: Deep and uplifting; covers a variety of product categories including food, clothing, beauty, personal care, electronics, and home goods.
URL… See the full description on the dataset page: https://huggingface.co/datasets/DataoceanAI/Chinese_Female_Speech_Synthesis_Corpus_Live_Streaming_for_Sales_with_Multi_Styles.multistream_conv_audio_2multistream_conv_audio
