CoolFace
Datasetpublic

BrunoHays/Bangor-Miami-Spanish-English-Corpus

Bangor Miami Spanish-English Corpus The Bangor Miami Corpus is a naturalistic Spanish-English code-switching speech dataset collected by Jon Russell Herring at Bangor University. It captures spontaneous bilingual conversations recorded in Miami, Florida, involving proficient Spanish-English bilinguals across multiple speaker groups. Dataset description Total recordings 56 Total duration ~32 h Languages English (en), Spanish (es) Format MP3 audio… See the full description on the dataset page: https://huggingface.co/datasets/BrunoHays/Bangor-Miami-Spanish-English-Corpus.

sourceHugging Facecc-by-sa-3.0updated 4mo agoView on Hugging Face
0likes121downloads
10 commits on main
84aea8c4mo ago

Fix config paths in YAML front matter

BrunoHays
ff7a9514mo ago

Remove old 5h config

BrunoHays
22506b14mo ago

Update model card: replace 5h config with mixed config

BrunoHays
26636c94mo ago

Add mixed config (20%–80% Spanish, ~2.5h)

BrunoHays
9ef909a4mo ago

Refresh default config

BrunoHays
f7fc5354mo ago

Add model card

BrunoHays
79af4e14mo ago

Add 5h balanced subset config

BrunoHays
11326a04mo ago

Drop speaker labels, add languages column, add duration_s

BrunoHays
bc847d44mo ago

Add Bangor Miami Spanish-English Corpus (56 recordings)

BrunoHays
7e886ba4mo ago

initial commit

BrunoHays