Team Ai
Datasetpublic

mlfoundations-dev/a1_code_sql_create_context_1744691318_eval_1331

mlfoundations-dev/a1_code_sql_create_context_1744691318_eval_1331 Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 GPQADiamond JEEBench MMLUPro LiveCodeBench CodeElo Accuracy 9.7 40.0 52.0 26.9 20.4 28.4 11.7 4.3 AIME24 Average Accuracy: 9.67% ± 1.20% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 6.67% 2 30 2 16.67% 5 30 3 16.67% 5 30… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/a1_code_sql_create_context_1744691318_eval_1331.

sourceHugging Faceupdated 1y agoView on Hugging Face
0likes21downloads
3 commits on main
0dda8cc1y ago

Upload README.md with huggingface_hub

sedrickkeh
b3e1d521y ago

Upload folder using huggingface_hub

sedrickkeh
c4b7f4a1y ago

initial commit

sedrickkeh