CoolFace
20 results

Diarization

niobures /synthetic-speech-diarization-ru synthetic-speech-diarization-ru Synthetic speech diarization dataset in Parquet format. Dataset Details Number of tracks: 2000 Sampling rate: 16000 Hz Audio format: Embedded in Parquet files (Audio feature compatible) Storage: Parquet format for efficient loading Dataset Structure The dataset contains audio tracks with speaker diarization annotations, stored directly in Parquet format. Features audio: Audio waveform (Audio feature with array and… See the full description on the dataset page: https://huggingface.co/datasets/niobures/synthetic-speech-diarization-ru.tabularautomatic-speech-recognition1K<n<10K0 likes205 downloads5mo agoHugging Facesmam /bengali-diarization-synthetic-v3audion<1K0 likes193 downloads7mo agoHugging Faceupb-nlp /echo-synthetic-diarization Echo (Synthetic Set for Diarization) This dataset is a synthetic dataset generated for evaluation of speaker diarization models. It contains approximately two hours of speech data, each file 60 seconds long, with and without overlap, with 2--5 speakers per file. This dataset has been built using Echo. audiovoice-activity-detectionn<1K0 likes183 downloads9mo agoHugging FaceBeijuka /luganda_callhome_diarization_dataset_MHDPaudion<1K0 likes163 downloads6mo agoHugging Faceokadahiroaki /voicevox-diarization-ja VOICEVOX合成 多話者日本語音声(話者分離検証用データセット) Qwen3-ASR の話者分離ファインチューニング検証、特に embedding層+projectorのみの学習で話者分離が学べるか を確かめるために作成した、正解ラベルが厳密な合成データです。 作り方 gemma(gemma-4-31B-it)で話題別のモノローグ日本語テキストを生成 文単位に分割し、各文境界で確率0.3で話者を切替(2〜3話者) 各文を割当てた VOICEVOX 話者で音声合成し連結 → 合成由来なので、各文の [開始秒, 終了秒] と話者が完全に既知(人手や別ASRに依存しない厳密ラベル)。 規模 698クリップ、各 約2分、opus (24kbps) / 16kHz 相当 mono 2話者 約88% / 3話者 約12% 話者は各クリップ内の登場順に spk_0, spk_1, spk_2 と採番 列 (data.jsonl) 列 内容… See the full description on the dataset page: https://huggingface.co/datasets/okadahiroaki/voicevox-diarization-ja.audioautomatic-speech-recognitionn<1K0 likes151 downloads3mo agoHugging Facetezuesh /diarization_datasetaudion<1K0 likes143 downloads1y agoHugging Face