models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
TR-HASH-MoE-1B-70B-Agentic-Pretrainingworkshop-pretraining-v2deep-ignorance-pretraining-stage-unfiltereddeep-ignorance-pretraining-stage-strong-filterTR-HASH-MoE-100M-125B-Agentic-PretrainingQwen2-1.5B-confluence-pretrainingpretraining_testpoker-pretrainingGemma3-Pretraining-TinyStoriesqwen3-micro-1kdeep-ignorance-pretraining-stage-weak-filterpretraining-priors-doormail4k-d32-treated-basemistral-pretrainingmistral-pretrainingpre-pretraining-10Mf-gpt2-small-42transformer-pretraining-from-scratchvicuna-7b-v1.3-tiny-stories-pretraining-2epochdeep_ignorance_pretraining_baseline_smalldeep_ignorance_pretraining_filtered_smallpretraining-priors-d26-base100k_fineweb_continued_pretraining_Qwen2.5-0.5B-Instruct_Unsloth_merged_16bit83k_continued_pretraining_Qwen2.5-0.5B-Instruct_Unsloth_merged_16bitdeep_aversion_pretraining_filtered_gdiff_v1_interleaved_1_in_100_gclip-0.5deep_aversion_pretraining_filtered_ga_interleaved_1_in_500_gclip-0.5_79864_starttrellis-pretraining10k_continued_pretraining_Qwen2.5-0.5B-Instruct_Unsloth_merged_16bit10k_continued_pretraining_Phi-3-mini-4k-instruct_Unsloth_merged_16bitdeep_aversion_pretraining_filtered_ga_interleaved_1_in_100_gclip-0.5_79864_starten-t5-sci-continued-pretraining-487ktest_continued_pretraining_Phi-3-mini-4k-instruct_Unsloth_merged_16bit
