CoolFace
Datasetpublic

UTokyo-Yokoya-Lab/webis-touche2020-v3-CSR-L

Touche2020-v3-CodeSwitching An MTEB dataset Massive Text Embedding Benchmark Code-switching version of mteb/webis-touche2020-v3, with queries rewritten in Chinese-English and Japanese-English code-switching styles. Dataset Structure The dataset contains the following configurations: From original dataset (unchanged): corpus: Original corpus documents default: Original relevance judgments (qrels) Code-switching additions: queries_zh_en: Chinese-English code-switching… See the full description on the dataset page: https://huggingface.co/datasets/UTokyo-Yokoya-Lab/webis-touche2020-v3-CSR-L.

sourceHugging Faceupdated 5mo agoView on Hugging Face
0likes25downloads
6 commits on main
45ca9a95mo ago

Update README.md

paddler2022
84247986mo ago

Update dataset card for code-switching version

paddler2022
af429436mo ago

Upload dataset

paddler2022
b935bdb6mo ago

Upload dataset

paddler2022
912df636mo ago

Remove original queries config

paddler2022
e815a706mo ago

Duplicate from mteb/webis-touche2020-v3

paddler2022, Samoed