Team Ai
Datasetpublic

years0/multilingual-code-switching-bench

Multilingual Code-Switching & Dialectal Evaluation Benchmark (Fatima Fellowship Application) Question 1: Critical Blind Spot & Capability Gap Standard NLP benchmarks (MMLU, GSM8K, HumanEval) evaluate language models on clean, standardized, monolingual inputs. However, for billions of global speakers, everyday digital communication occurs in low-resource code-switched vernaculars (e.g., Franco-Arabic/Arabizi, Singlish, Taglish, Hinglish, Naija Pidgin, Sheng… See the full description on the dataset page: https://huggingface.co/datasets/years0/multilingual-code-switching-bench.

sourceHugging Facemitupdated 3d agoView on Hugging Face
0likes43downloads
6 commits on main
b8357033d ago

Delete llama3_evaluation_results.json

years0
4855ab73d ago

Upload llama3_evaluation_results.json

years0
6478cbf3d ago

Delete llama3_evaluation_results.json (#1)

years0, MouradGad
1693d323d ago

Create README.md

years0
638ea483d ago

Upload 2 files

years0
0d274b43d ago

initial commit

years0