PiC/phrase_similarity
Phrase in Context is a curated benchmark for phrase understanding and semantic search, consisting of three tasks of increasing difficulty: Phrase Similarity (PS), Phrase Retrieval (PR) and Phrase Sense Disambiguation (PSD). The datasets are annotated by 13 linguistic experts on Upwork and verified by two groups: ~1000 AMT crowdworkers and another set of 5 linguistic experts. PiC benchmark is distributed under CC-BY-NC 4.0.
Update phrase_similarity.py
Update phrase_similarity.py
Update phrase_similarity.py
Update phrase_similarity.py
Update phrase_similarity.py
Delete data
Update phrase_similarity.py
Upload dataset_infos.json with huggingface_hub
Delete data/test-00000-of-00001-da1042069f928a8c.parquet with huggingface_hub
Upload data/test-00000-of-00001-f89456dc448d8e32.parquet with huggingface_hub
Delete data/validation-00000-of-00001-e53bf03df554e682.parquet with huggingface_hub
Upload data/validation-00000-of-00001-6df700a94a026715.parquet with huggingface_hub
Delete data/train-00000-of-00001-438d56cdbd9c112e.parquet with huggingface_hub
Upload data/train-00000-of-00001-20fae14a62b0fda5.parquet with huggingface_hub
Update phrase_similarity.py
Upload dataset_infos.json with huggingface_hub
Upload dataset_infos.json with huggingface_hub
Delete data/test-00000-of-00001-b3500099f476da1b.parquet with huggingface_hub
Upload data/test-00000-of-00001-da1042069f928a8c.parquet with huggingface_hub
Delete data/validation-00000-of-00001-aba01ce418f7fbe5.parquet with huggingface_hub
Upload data/validation-00000-of-00001-e53bf03df554e682.parquet with huggingface_hub
Delete data/train-00000-of-00001-c17e47113937a357.parquet with huggingface_hub
Upload data/train-00000-of-00001-438d56cdbd9c112e.parquet with huggingface_hub
Update README.md
Update new data with more challenging negative examples.
Upload dataset_infos.json with huggingface_hub
Upload data/test-00000-of-00001-b3500099f476da1b.parquet with huggingface_hub
Upload data/validation-00000-of-00001-aba01ce418f7fbe5.parquet with huggingface_hub
Upload data/train-00000-of-00001-c17e47113937a357.parquet with huggingface_hub
Update new data with more challenging negative examples.
Update phrase_similarity.py
Remove redundant subset.
Update phrase_similarity.py
Update phrase_similarity.py
Update phrase_similarity.py
Update phrase_similarity.py
Update README.md
Update README.md
Fix `license` metadata (#1)
Update README.md
Update README.md
Update README.md
Update README.md
Added dataset license, authors, and cite
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
