bdatm-project/evaluation-results-task3
Model-comparison table for this task: one row per evaluated model, written by push_results_table in src/eval/utilities.py. Per-sample predictions are in per_sample/.
0106
Model-comparison table for this task: one row per evaluated model, written by push_results_table in src/eval/utilities.py. Per-sample predictions are in per_sample/.
