Team Ai
Datasetpublic

mlfoundations-dev/a1_code_coder_stat_eval_636d

mlfoundations-dev/a1_code_coder_stat_eval_636d Precomputed model outputs for evaluation. Evaluation Results Summary Metric AIME24 AMC23 MATH500 MMLUPro JEEBench GPQADiamond LiveCodeBench CodeElo CodeForces Accuracy 14.3 59.2 75.6 32.0 40.1 42.3 21.5 10.5 10.2 AIME24 Average Accuracy: 14.33% ± 1.25% Number of Runs: 10 Run Accuracy Questions Solved Total Questions 1 10.00% 3 30 2 16.67% 5 30 3 20.00% 6… See the full description on the dataset page: https://huggingface.co/datasets/mlfoundations-dev/a1_code_coder_stat_eval_636d.

sourceHugging Faceupdated 1y agoView on Hugging Face
0likes8downloads
18 commits on main
d5390231y ago

Upload README.md with huggingface_hub

ryanmarten
4d56ec21y ago

Adding shard 1

ryanmarten
eafc6a21y ago

Adding shard 8

ryanmarten
2a4f2471y ago

Adding shard 2

ryanmarten
01186891y ago

Adding shard 4

ryanmarten
53a65781y ago

Adding shard 13

ryanmarten
51abb9a1y ago

Adding shard 5

ryanmarten
101719f1y ago

Adding shard 10

ryanmarten
1937f6e1y ago

Adding shard 12

ryanmarten
4511eaf1y ago

Adding shard 11

ryanmarten
da498801y ago

Adding shard 7

ryanmarten
cf3abe21y ago

Adding shard 15

ryanmarten
53d488a1y ago

Adding shard 6

ryanmarten
b49276b1y ago

Adding shard 9

ryanmarten
825050a1y ago

Adding shard 3

ryanmarten
c619cd91y ago

Adding shard 14

ryanmarten
8824c201y ago

Adding shard 0

ryanmarten
450b3dc1y ago

initial commit

ryanmarten