Nexdata-kr/172-hours-American-English-Full-Duplex-Multi-Channel-Speech-Dataset
Description 주제 기반 대화로 수집한 미국 영어 멀티스트림 자연 발화 스마트폰 음성 데이터셋입니다. 각 음성 데이터에는 대화 내용을 전사한 텍스트와 화자 ID, 성별, 연령 등의 속성 정보가 포함되어 있습니다. 본 데이터셋은 다양한 지역과 배경을 가진 폭넓은 화자들로부터 수집되었으며, 실제 환경에서 발생하는 복잡하고 다양한 음성 상황에 대한 모델의 성능 향상에 활용할 수 있습니다. 자세한 내용은 아래 링크를 참고해 주세요: https://ko.nexdata.ai/datasets/speechrecog/1770?fromCategoryPage=1?source=hf.kr Specifications Format 16 kHz, 16 bit, 비압축 WAV, 모노 채널, 화자별 채널 분리 Content category 주제 기반 자연 대화 Recording condition 낮은 배경 소음 환경(실내) Recording device Android 스마트폰, iPhone Country… See the full description on the dataset page: https://huggingface.co/datasets/Nexdata-kr/172-hours-American-English-Full-Duplex-Multi-Channel-Speech-Dataset.
Description
주제 기반 대화로 수집한 미국 영어 멀티스트림 자연 발화 스마트폰 음성 데이터셋입니다. 각 음성 데이터에는 대화 내용을 전사한 텍스트와 화자 ID, 성별, 연령 등의 속성 정보가 포함되어 있습니다. 본 데이터셋은 다양한 지역과 배경을 가진 폭넓은 화자들로부터 수집되었으며, 실제 환경에서 발생하는 복잡하고 다양한 음성 상황에 대한 모델의 성능 향상에 활용할 수 있습니다. 자세한 내용은 아래 링크를 참고해 주세요: https://ko.nexdata.ai/datasets/speechrecog/1770?fromCategoryPage=1?source=hf.kr
Specifications
Format
16 kHz, 16 bit, 비압축 WAV, 모노 채널, 화자별 채널 분리
Content category
주제 기반 자연 대화
Recording condition
낮은 배경 소음 환경(실내)
Recording device
Android 스마트폰, iPhone
Country
미국(USA)
Language(Region) Code
en-US
Language
영어
Features of annotation
전사 텍스트, 타임스탬프, 화자 ID, 성별, 노이즈 정보
Accuracy rate
단어 정확도(WAR) 98%
Licensing Information
상업용 라이선스
