CoolFace
Datasetpublic

sentence-transformers/msmarco-distilbert-margin-mse-cls-dot-v2

MS MARCO with hard negatives from distilbert-margin-mse-cls-dot-v2 MS MARCO is a large scale information retrieval corpus that was created based on real user search queries using the Bing search engine. For each query and gold positive passage, the 50 most similar paragraphs were mined using 13 different models. The resulting data can be used to train Sentence Transformer models. Related Datasets These are the datasets generated using the 13 different models:… See the full description on the dataset page: https://huggingface.co/datasets/sentence-transformers/msmarco-distilbert-margin-mse-cls-dot-v2.

sourceHugging Faceupdated 2y agoView on Hugging Face
2likes237downloads
17 commits on main
fed5fad2y ago

Update README.md

tomaarsen
cc402622y ago

Upload dataset

tomaarsen
fec7d652y ago

Upload dataset

tomaarsen
f76ad2f2y ago

Upload dataset

tomaarsen
8bcadbc2y ago

Upload dataset

tomaarsen
9f7edeb2y ago

Upload dataset

tomaarsen
96647b12y ago

Upload dataset

tomaarsen
e13a8d62y ago

Upload dataset

tomaarsen
58060af2y ago

Upload dataset

tomaarsen
f2c92672y ago

Upload dataset

tomaarsen
7fee12c2y ago

Upload dataset

tomaarsen
c95ea8b2y ago

Upload dataset

tomaarsen
63199222y ago

Upload dataset

tomaarsen
fbe33ed2y ago

Upload dataset (part 00001-of-00002)

tomaarsen
b25a8c62y ago

Upload dataset (part 00000-of-00002)

tomaarsen
307105d2y ago

Upload dataset

tomaarsen
b9280112y ago

initial commit

tomaarsen