CoolFace
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01mlfoundations-dev /b2_code_embeddingtabular10K<n<100K0 likes14 downloads1y agoHugging Face02mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_meantabular10K<n<100K0 likes13 downloads2y agoHugging Face03mlfoundations-dev /instruction_filtering_embedding_filter_mean_seed_data_code_w_openthoughtstabular100K<n<1M0 likes10 downloads2y agoHugging Face04mlfoundations-dev /instruction_filtering_embedding_filter_seed_data_code_w_openthoughtstabular100K<n<1M0 likes10 downloads2y agoHugging Face05mlfoundations-dev /embedding_codetabularn<1K0 likes9 downloads1y agoHugging Face06mlfoundations-dev /b2_code_embedding_filter_open_code_reasoningtabular10K<n<100K0 likes9 downloads1y agoHugging Face07mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_16Ktabular10K<n<100K0 likes7 downloads2y agoHugging Face08mlfoundations-dev /b2_code_embedding_10k_eval_636d mlfoundations-dev/b2_code_embedding_10k_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 19.3 50.5 71.0 29.6 27.8 28.3 35.9 8.4 9.0 AIME24 Average Accuracy: 19.33% ± 1.23% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 20.00% 6 30 2 13.33% 4 30 3 20.00% 6 30 4 13.33% 4… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_10k_eval_636d.tabular1K<n<10K0 likes7 downloads1y agoHugging Face09mlfoundations-dev /b2_code_embedding_0.3k_eval_636d mlfoundations-dev/b2_code_embedding_0.3k_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 18.7 55.8 74.8 26.6 42.1 34.8 28.2 7.3 8.7 AIME24 Average Accuracy: 18.67% ± 1.84% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 13.33% 4 30 2 13.33% 4 30 3 16.67% 5 30 4 20.00% 6… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_0.3k_eval_636d.tabular1K<n<10K0 likes7 downloads1y agoHugging Face10mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domaintabular10K<n<100K0 likes6 downloads2y agoHugging Face11mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_8Ktabular1K<n<10K0 likes6 downloads2y agoHugging Face12mlfoundations-dev /b2_code_embedding_10ktabular10K<n<100K0 likes6 downloads1y agoHugging Face13mlfoundations-dev /b2_code_embedding_1k_eval_636d mlfoundations-dev/b2_code_embedding_1k_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 12.3 39.2 67.8 26.8 33.9 31.8 19.0 4.3 5.8 AIME24 Average Accuracy: 12.33% ± 2.16% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 10.00% 3 30 2 3.33% 1 30 3 16.67% 5 30 4 6.67% 2 30… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_1k_eval_636d.tabular1K<n<10K0 likes6 downloads1y agoHugging Face14mlfoundations-dev /b2_code_embedding_3k_eval_636d mlfoundations-dev/b2_code_embedding_3k_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 21.7 62.5 75.2 28.8 43.8 40.4 34.7 9.4 12.5 AIME24 Average Accuracy: 21.67% ± 1.84% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 16.67% 5 30 2 33.33% 10 30 3 16.67% 5 30 4 20.00% 6… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_3k_eval_636d.tabular1K<n<10K0 likes6 downloads1y agoHugging Face15mlfoundations-dev /instruction_filtering_embedding_filter_codetabular1K<n<10K0 likes5 downloads2y agoHugging Face16mlfoundations-dev /instruction_filtering_embedding_filter_code_meantabular1K<n<10K0 likes5 downloads2y agoHugging Face17mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_16Ktabular10K<n<100K0 likes5 downloads2y agoHugging Face18mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_2Ktabular1K<n<10K0 likes5 downloads2y agoHugging Face19mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_8Ktabular1K<n<10K0 likes5 downloads2y agoHugging Face20mlfoundations-dev /b2_code_embedding_filter_code_golftabular10K<n<100K0 likes5 downloads1y agoHugging Face21mlfoundations-dev /b2_code_embedding_3ktabular1K<n<10K0 likes5 downloads1y agoHugging Face22mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_2Ktabular1K<n<10K0 likes4 downloads2y agoHugging Face23mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_1Ktabular1K<n<10K0 likes4 downloads2y agoHugging Face24mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_1Ktabular1K<n<10K0 likes4 downloads2y agoHugging Face25mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_4Ktabular1K<n<10K0 likes4 downloads2y agoHugging Face26mlfoundations-dev /b2_calc_positive_embeddings_codetabular1K<n<10K0 likes4 downloads1y agoHugging Face27mlfoundations-dev /b2_calc_positive_embeddings_code_ioitabularn<1K0 likes4 downloads1y agoHugging Face28mlfoundations-dev /b2_code_embedding_eval_636d mlfoundations-dev/b2_code_embedding_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 25.3 63.5 71.4 29.4 43.2 43.1 45.6 2.1 1.0 AIME24 Average Accuracy: 25.33% ± 1.96% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 23.33% 7 30 2 30.00% 9 30 3 16.67% 5 30 4 20.00% 6 30… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_eval_636d.tabular1K<n<10K0 likes4 downloads1y agoHugging Face29mlfoundations-dev /b2_code_embedding_1ktabular1K<n<10K0 likes4 downloads1y agoHugging Face30mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_4Ktabular1K<n<10K0 likes3 downloads2y agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.