language modeling
BabyLM-130M-ilm_it-ilm_pl-tokenizer_ilm_bilingual_it_pl_bpe_trailing_ws_32000BabyLM-130M-ilm_it-ilm_pl-tokenizer_ilm_bilingual_it_pl_unigram_32000BabyLM-130M-ilm_eu-tokenizer_ilm_mono_eu_bpe_32000BabyLM-130M-ilm_it-tokenizer_ilm_mono_it_bpe_32000BabyLM-130M-ilm_es-tokenizer_ilm_mono_es_bpe_32000BabyLM-130M-ilm_sl-tokenizer_ilm_mono_sl_bpe_32000BabyLM-130M-ilm_pl-tokenizer_ilm_mono_pl_bpe_32000BabyLM-130M-ilm_pl-ilm_sl-tokenizer_ilm_bilingual_pl_sl_unigram_32000
Towards-Joint-Modeling-of-Dialogue-Response-and-Speech-Synthesis-based-on-Large-Language-Modelpiqa_es
Dataset Card for PIQA (Spanish Version)
Dataset summary
This dataset provides the Spanish translation and adaptation of the validation
set of PIQA (Physical Interaction: Question Answering). The original dataset
was designed to evaluate physical commonsense reasoning in language models
through questions about everyday situations. Each example presents a physical
goal and two possible solutions, only one of which is correct.
This Spanish adaptation enables… See the full description on the dataset page: https://huggingface.co/datasets/langtech-languagemodeling/piqa_es.ilm_deilm_esALIABOOST-C2masked_language_modeling_for_Telugu_language
