Team Ai
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01mlfoundations-dev /instruction_filtering_embedding_filter_seed_data_code_w_openthoughtstabular100K<n<1M0 likes17 downloads2y agoHugging Face02mlfoundations-dev /instruction_filtering_embedding_filter_mean_seed_data_code_w_openthoughtstabular100K<n<1M0 likes15 downloads2y agoHugging Face03mlfoundations-dev /b2_code_embeddingtabular10K<n<100K0 likes15 downloads1y agoHugging Face04mlfoundations-dev /embedding_codetabularn<1K0 likes14 downloads1y agoHugging Face05mlfoundations-dev /b2_code_embedding_10ktabular10K<n<100K0 likes14 downloads1y agoHugging Face06mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_16Ktabular10K<n<100K0 likes12 downloads2y agoHugging Face07mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_meantabular10K<n<100K0 likes11 downloads2y agoHugging Face08mlfoundations-dev /b2_code_embedding_filter_open_code_reasoningtabular10K<n<100K0 likes10 downloads1y agoHugging Face09mlfoundations-dev /instruction_filtering_embedding_filter_codetabular1K<n<10K0 likes9 downloads2y agoHugging Face10mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_16Ktabular10K<n<100K0 likes9 downloads2y agoHugging Face11mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domaintabular10K<n<100K0 likes8 downloads2y agoHugging Face12mlfoundations-dev /instruction_filtering_embedding_filter_code_meantabular1K<n<10K0 likes7 downloads2y agoHugging Face13mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_8Ktabular1K<n<10K0 likes7 downloads2y agoHugging Face14mlfoundations-dev /b2_code_embedding_3ktabular1K<n<10K0 likes7 downloads1y agoHugging Face15mlfoundations-dev /b2_code_embedding_10k_eval_636d mlfoundations-dev/b2_code_embedding_10k_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 19.3 50.5 71.0 29.6 27.8 28.3 35.9 8.4 9.0 AIME24 Average Accuracy: 19.33% ± 1.23% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 20.00% 6 30 2 13.33% 4 30 3 20.00% 6 30 4 13.33% 4… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_10k_eval_636d.tabular1K<n<10K0 likes7 downloads1y agoHugging Face16mlfoundations-dev /b2_code_embedding_0.3k_eval_636d mlfoundations-dev/b2_code_embedding_0.3k_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 18.7 55.8 74.8 26.6 42.1 34.8 28.2 7.3 8.7 AIME24 Average Accuracy: 18.67% ± 1.84% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 13.33% 4 30 2 13.33% 4 30 3 16.67% 5 30 4 20.00% 6… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_0.3k_eval_636d.tabular1K<n<10K0 likes7 downloads1y agoHugging Face17mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_4Ktabular1K<n<10K0 likes6 downloads2y agoHugging Face18mlfoundations-dev /b2_code_embedding_1k_eval_636d mlfoundations-dev/b2_code_embedding_1k_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 12.3 39.2 67.8 26.8 33.9 31.8 19.0 4.3 5.8 AIME24 Average Accuracy: 12.33% ± 2.16% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 10.00% 3 30 2 3.33% 1 30 3 16.67% 5 30 4 6.67% 2 30… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_1k_eval_636d.tabular1K<n<10K0 likes6 downloads1y agoHugging Face19mlfoundations-dev /b2_code_embedding_3k_eval_636d mlfoundations-dev/b2_code_embedding_3k_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 21.7 62.5 75.2 28.8 43.8 40.4 34.7 9.4 12.5 AIME24 Average Accuracy: 21.67% ± 1.84% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 16.67% 5 30 2 33.33% 10 30 3 16.67% 5 30 4 20.00% 6… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/b2_code_embedding_3k_eval_636d.tabular1K<n<10K0 likes6 downloads1y agoHugging Face20mlfoundations-dev /b2_code_embedding_filter_code_golftabular10K<n<100K0 likes5 downloads1y agoHugging Face21mlfoundations-dev /b2_code_embedding_1ktabular1K<n<10K0 likes5 downloads1y agoHugging Face22mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_8Ktabular1K<n<10K0 likes4 downloads2y agoHugging Face23mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_1Ktabular1K<n<10K0 likes4 downloads2y agoHugging Face24mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_per_domain_2Ktabular1K<n<10K0 likes4 downloads2y agoHugging Face25mlfoundations-dev /b2_calc_positive_embeddings_codetabular1K<n<10K0 likes4 downloads1y agoHugging Face26mlfoundations-dev /b2_calc_positive_embeddings_code_ioitabularn<1K0 likes4 downloads1y agoHugging Face27mlfoundations-dev /b2_code_embedding_0.3ktabularn<1K0 likes4 downloads1y agoHugging Face28mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_4Ktabular1K<n<10K0 likes3 downloads2y agoHugging Face29mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_2Ktabular1K<n<10K0 likes3 downloads2y agoHugging Face30mlfoundations-dev /instruction_filtering_scale_up_code_base_embedding_filter_mean_1Ktabular1K<n<10K0 likes3 downloads2y agoHugging Face

Listings come live from the Hugging Face Hub API. Team Ai does not host these files.