CoolFace
Datasetpublic

Nexdata-kr/2-People-Korean-Natural-Conversation-Average-Tone-Speech-Synthesis-Corpus

Description 48kHz, 24bit 품질의 영어 음성 데이터셋으로, 전문 녹음 스튜디오에서 전문 성우 2명(남성 1명, 여성 1명)의 음성을 수집했습니다. 주어진 주제에 대한 즉흥 발화, 다단계 감정, 단일 감정 및 준언어적 특성(Paralinguistic Features) 등 다양한 음성 콘텐츠를 포함합니다. 텍스트, 감정 및 준언어적 특성에 대한 어노테이션을 제공하며, 음성 합성(Speech Synthesis) 등의 음성 AI 모델 개발 및 학습에 활용할 수 있습니다. 자세한 내용은 아래 링크를 참고해 주세요: https://ko.nexdata.ai/datasets/tts/1540?source=hf.kr Specifications Format 48kHz, 24bit, 비압축 WAV, 모노 채널 Recording Environment 전문 녹음 스튜디오… See the full description on the dataset page: https://huggingface.co/datasets/Nexdata-kr/2-People-Korean-Natural-Conversation-Average-Tone-Speech-Synthesis-Corpus.

sourceHugging Faceupdated 3d agoView on Hugging Face
0likes28downloads
Dataset Card

Description

48kHz, 24bit 품질의 영어 음성 데이터셋으로, 전문 녹음 스튜디오에서 전문 성우 2명(남성 1명, 여성 1명)의 음성을 수집했습니다. 주어진 주제에 대한 즉흥 발화, 다단계 감정, 단일 감정 및 준언어적 특성(Paralinguistic Features) 등 다양한 음성 콘텐츠를 포함합니다.

텍스트, 감정 및 준언어적 특성에 대한 어노테이션을 제공하며, 음성 합성(Speech Synthesis) 등의 음성 AI 모델 개발 및 학습에 활용할 수 있습니다.

자세한 내용은 아래 링크를 참고해 주세요: https://ko.nexdata.ai/datasets/tts/1540?source=hf.kr

Specifications

Format

48kHz, 24bit, 비압축 WAV, 모노 채널

Recording Environment

전문 녹음 스튜디오

Recording Content

다음과 같은 음성 콘텐츠를 포함합니다.

  • —주제 기반 즉흥 발화
  • —다단계 감정
  • —단일 감정
  • —준언어적 특성

Personnel

전문 성우 2명(남성 1명, 여성 1명)

Annotation Features

텍스트 어노테이션, 감정 어노테이션, 준언어적 특성 어노테이션

Equipment

전문 녹음 장비 및 소프트웨어

Language

영어

Application Scenario

음성 합성(Speech Synthesis)

Licensing Information

상업용 라이선스