Team Ai
Datasetpublic

mlfoundations-dev/a1_code_sql_create_context_1744691318_eval_1331

mlfoundations-dev/a1_code_sql_create_context_1744691318_eval_1331 Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 GPQADiamond JEEBench MMLUPro LiveCodeBench CodeElo Accuracy 9.7 40.0 52.0 26.9 20.4 28.4 11.7 4.3 AIME24 Average Accuracy: 9.67% ± 1.20% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 6.67% 2 30 2 16.67% 5 30 3 16.67% 5 30… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/a1_code_sql_create_context_1744691318_eval_1331.

sourceHugging Faceupdated 1y agoView on Hugging Face
0likes21downloads
filetrain-00000-of-00008.parquet3.7 MBdownload
filetrain-00001-of-00008.parquet3.8 MBdownload
filetrain-00002-of-00008.parquet3.7 MBdownload
filetrain-00003-of-00008.parquet3.7 MBdownload
filetrain-00004-of-00008.parquet4.0 MBdownload
filetrain-00005-of-00008.parquet3.8 MBdownload
filetrain-00006-of-00008.parquet3.8 MBdownload
filetrain-00007-of-00008.parquet3.7 MBdownload

mlfoundations-dev/a1_code_sql_create_context_1744691318_eval_1331 · main · files are served by the source, never re-hosted here