models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
tulu-v2.5-13b-stackexchange-60k-rmgpt2_stack-exchange-paired_rmts_1000_hubllama-7b_stack-exchange_RM_peft-adapter-mergedgpt2-xl-stackexchange_stack-exchange-paired_reward_model_train_subset_1000gpt2_stack-exchange-paired_reward_modelgpt2-xl-stackexchange_stack-exchange-paired_rmts_240000_bupBert-Stack-Exchangegpt2-xl-stackexchange_stack-exchange-paired_rmts_240000gpt2-xl-stackexchange_stack-exchange-paired_rmts_1000_hubgpt2-xl-stackexchange_stack-exchange-paired_rmts__240000_8e-05_hubModerBert-MultiLabel-StackExchange-stack_exp_imb_exp1gpt2-xl-stackexchange_stack-exchange-paired_rmts__240000_1e-05_hubgpt2-xl-stackexchange_stack-exchange-paired_rmts__240000_2e-05_hubroberta-base_peft_stack-exchange-paired_rmts__10000_2e-05llama-7b-hf_peft_stack-exchange-paired_rmts__100000_2e-05_peft_last_checkpoint_oct4_mergedgpt2_stack-exchange-paired_rmts_1000gpt2-xl-stackexchange_stack-exchange-paired_rmts__240000_4e-05_hubgpt2_stack-exchange-paired_rmts__10000_2e-05_hub
