datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
r1-model_generatedrouter_SFT_larger_model_generated_data_Math_Qwen3-1.7Brouter_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-4B_aimebeautiful_interesting_spectacular_photo_model_30000_with_generated_captions
Dataset Card for "beautiful_interesting_spectacular_photo_model_30000_with_generated_captions"
More Information needed
router_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-1.7Bmodel_generated_summariesTrain split consist of 100,000 model generated summaries. Validation and Test split each consist of 20000 model generated summaries.
For each domain and each model, there are 5,000 training, 1,000 validation, and 1,000 test samples
Domain:
-News (source document retrieved from https://huggingface.co/datasets/abisee/cnn_dailymail)
-Arxiv research articles (source document retrieved from https://huggingface.co/datasets/ccdv/arxiv-summarization)
-Reddit posts (source document retrieved from… See the full description on the dataset page: https://huggingface.co/datasets/yujin31/model_generated_summaries.router_SFT_larger_model_generated_data_Math_Qwen3-4Brouter_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-14BM_0_generated__gsm8k_model_pool__qwen_score_qwenrouter_SFT_larger_model_generated_data_Math_Qwen3-14Brouter_SFT_larger_model_generated_data_Math_OLMo-2-1124-13B-Instructdata_modelGenerated
Dataset Card for "data_modelGenerated"
More Information needed
M_0_generated__truthfulqa_gen_model_pool__zephyr_rspLIMA-model-generated-amd-AMD-OLMo-1B-SFT
LIMA Paraphrased Prompts + OLMo-Generated Responses
What this is.A companion to the paraphrased LIMA set. Each item keeps the original single-turn structure but replaces the assistant side with a new response generated by amd/AMD-OLMo-1B-SFT, conditioned on the paraphrased user prompt (from GPT-4o-mini).
Data schema
Each row is a dictionary with:
id (string) — original LIMA/TÜLU identifier.
model_generated_messages (list of dicts) — paraphrased user + new OLMo answer:… See the full description on the dataset page: https://huggingface.co/datasets/lukashinterleitner/LIMA-model-generated-amd-AMD-OLMo-1B-SFT.router_SFT_larger_model_generated_data_mmlu_pro_science_OLMo-2-1124-13B-Instructrouter_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-8Brouter_SFT_larger_model_generated_data_Math_Qwen3-8BM_0_generated__gsm8k_model_pool__mistral_score_gemmadeepmath_data_generated_by_rlt_modelrouter_SFT_larger_model_generated_data_Math_Qwen3-0.6Brouter_SFT_larger_model_generated_data_Math_OLMo-2-1124-7B-Instructrouter_SFT_larger_model_generated_data_mmlu_pro_science_OLMo-2-1124-7B-Instructrouter_SFT_larger_model_generated_data_mmlu_pro_science_Meta-Llama-3-8B-Instructrouter_SFT_larger_model_generated_data_Math_Meta-Llama-3-8B-InstructM_0_generated__truthfulqa_gen_model_pool__mistral_rspM_0_generated__gsm8k_model_pool__mistral_rspM_0_generated__truthfulqa_gen_model_pool__gemma-2_score_gemma-2M_0_generated__truthfulqa_gen_model_pool__gemma-2_rspM_0_generated__truthfulqa_gen_model_pool__zephyr_score_mistralM_0_generated__truthfulqa_gen_model_pool__zephyr_score_gemma-2
