bdatm-project/evaluation-results-task2
Model-comparison table for this task: one row per evaluated model, written by push_results_table in src/eval/utilities.py. Per-sample predictions are in per_sample/.
0137
Model-comparison table for this task: one row per evaluated model, written by push_results_table in src/eval/utilities.py. Per-sample predictions are in per_sample/.
