masuidrive/cv-corpus-17.0-zh-TW-client_id-grouped
cv-corpus-17.0-zh-TW-client_id-grouped This dataset is a subset of the Common Voice dataset, filtered and grouped based on the client ID (treated as speaker ID). Dataset Details The dataset is derived from the Common Voice dataset. The original dataset is available at Common Voice Dataset. The dataset is grouped by client ID, which is treated as the speaker ID for this dataset. Each group is filtered to include only client IDs with a minimum of 30 samples and a… See the full description on the dataset page: https://huggingface.co/datasets/masuidrive/cv-corpus-17.0-zh-TW-client_id-grouped.
1301
train_0.parquetdownload
train_1.parquetdownload
train_10.parquetdownload
train_11.parquetdownload
train_12.parquetdownload
train_13.parquetdownload
train_14.parquetdownload
train_15.parquetdownload
train_16.parquetdownload
train_17.parquetdownload
train_18.parquetdownload
train_19.parquetdownload
train_2.parquetdownload
train_20.parquetdownload
train_21.parquetdownload
train_22.parquetdownload
train_23.parquetdownload
train_24.parquetdownload
train_25.parquetdownload
train_26.parquetdownload
train_27.parquetdownload
train_28.parquetdownload
train_29.parquetdownload
train_3.parquetdownload
train_30.parquetdownload
train_31.parquetdownload
train_32.parquetdownload
train_33.parquetdownload
train_34.parquetdownload
train_35.parquetdownload
train_36.parquetdownload
train_4.parquetdownload
train_5.parquetdownload
train_6.parquetdownload
train_7.parquetdownload
train_8.parquetdownload
train_9.parquetdownload
validation_0.parquetdownload
validation_1.parquetdownload
validation_2.parquetdownload
validation_3.parquetdownload
validation_4.parquetdownload
validation_5.parquetdownload
validation_6.parquetdownload
validation_7.parquetdownload
validation_8.parquetdownload
validation_9.parquetdownload
