CoolFace
Datasetpublic

Nexdata-kr/214-Hours-Korean-Full-Duplex-Multi-Channel-Speech-Dataset

Description 주제 기반 대화로 수집한 한국어(대한민국) 멀티스트림 자연 발화 스마트폰 음성 데이터셋입니다. 각 음성 데이터에는 대화 내용을 전사한 텍스트와 화자 ID, 성별, 연령 등의 속성 정보가 포함되어 있습니다. 본 데이터셋은 다양한 지역과 배경을 가진 폭넓은 화자들로부터 수집되었으며, 실제 환경에서 발생하는 복잡하고 다양한 음성 상황에 대한 모델의 성능 향상에 활용할 수 있습니다. 자세한 내용은 아래 링크를 참고해 주세요: https://ko.nexdata.ai/datasets/speechrecog/1704?source=hf.kr Specifications Format 16 kHz, 16 bit, WAV, 모노 채널 Content category 정해진 주제 없이 자유롭게 진행된 자연 대화 Recording condition 낮은… See the full description on the dataset page: https://huggingface.co/datasets/Nexdata-kr/214-Hours-Korean-Full-Duplex-Multi-Channel-Speech-Dataset.

sourceHugging Faceupdated 19d agoView on Hugging Face
2likes164downloads
Dataset Card

Description

주제 기반 대화로 수집한 한국어(대한민국) 멀티스트림 자연 발화 스마트폰 음성 데이터셋입니다. 각 음성 데이터에는 대화 내용을 전사한 텍스트와 화자 ID, 성별, 연령 등의 속성 정보가 포함되어 있습니다. 본 데이터셋은 다양한 지역과 배경을 가진 폭넓은 화자들로부터 수집되었으며, 실제 환경에서 발생하는 복잡하고 다양한 음성 상황에 대한 모델의 성능 향상에 활용할 수 있습니다.

자세한 내용은 아래 링크를 참고해 주세요: https://ko.nexdata.ai/datasets/speechrecog/1704?source=hf.kr

Specifications

Format

16 kHz, 16 bit, WAV, 모노 채널

Content category

정해진 주제 없이 자유롭게 진행된 자연 대화

Recording condition

낮은 배경 소음 환경(실내)

Recording device

Android 스마트폰, iPhone

Speaker

약 200명

Country

대한민국

Language

한국어

Features of annotation

전사 텍스트, 타임스탬프, 화자 ID, 성별

Accuracy Rate

단어 정확도(WAR) 98%

Licensing Information

상업용 라이선스