multi-stream
multi-stream-spontaneous-conversation-training-datasets_chinese
Multi-stream Spontaneous Conversation Training Datasets_Chinese
Every data point counts.
Dataset Basic Info
Dataset Type: ASR Corpus
Language: Chinese
Audio Parameters: 16 kHz, 16 bits
File Format: WAV (PCM)
Recording Equipment: Mobile device
Dataset Description
The Multi-stream conversation dataset developed by MagicData captures each speaker's audio track and labels each speaker separately, thereby preserving the natural occurrences of… See the full description on the dataset page: https://huggingface.co/datasets/MagicHub/multi-stream-spontaneous-conversation-training-datasets_chinese.multi-stream-spontaneous-conversation-training-datasets_chinese
Multi-stream Spontaneous Conversation Training Datasets_Chinese
Every data point counts.
Dataset Basic Info
Dataset Type: ASR Corpus
Language: Chinese
Audio Parameters: 16 kHz, 16 bits
File Format: WAV (PCM)
Recording Equipment: Mobile device
Dataset Description
The Multi-stream conversation dataset developed by MagicData captures each speaker's audio track and labels each speaker separately, thereby preserving the natural occurrences of… See the full description on the dataset page: https://huggingface.co/datasets/MagicDataTech/multi-stream-spontaneous-conversation-training-datasets_chinese.multi-stream-spontaneous-conversation-training-datasets_english
Multi-stream Spontaneous Conversation Training Datasets_English
Every data point counts.
Dataset Basic Info
Dataset Type: ASR Corpus
Language: English
Audio Parameters: 16 kHz, 16 bits
File Format: WAV (PCM)
Recording Equipment: Mobile device
Dataset Description
The Multi-stream conversation dataset developed by MagicData captures each speaker's audio track and labels each speaker separately, thereby preserving the natural occurrences of… See the full description on the dataset page: https://huggingface.co/datasets/MagicHub/multi-stream-spontaneous-conversation-training-datasets_english.Chinese_Female_Speech_Synthesis_Corpus_Live_Streaming_for_Sales_with_Multi_Styles
ID
King-TTS-241
Duration
8.56 hours
Speakers
100 People
Labeling Details
Pronunciation, Rhythm, Breath sounds marked with {hx}
Language
Chinese
Description
Two styles: Deep and uplifting; covers a variety of product categories including food, clothing, beauty, personal care, electronics, and home goods.
URL… See the full description on the dataset page: https://huggingface.co/datasets/DataoceanAI/Chinese_Female_Speech_Synthesis_Corpus_Live_Streaming_for_Sales_with_Multi_Styles.multistream_conv_audio_2multistream_conv_audio
