models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
selfpres-dog_preference_gen1_seed0Phi1.5-openhermes-preferences-metamathselfpres-owl_preference_gen1_seed0configurable-preference-rocinante-12bselfpres-phoenix_preference_gen1_seed0selfpres-owl_preference_gen1_seed1selfpres-cat_preference_gen1_seed0selfpres-dog_preference_gen2_seed1selfpres-owl_preference_gen1_seed2selfpres-dog_preference_gen1_seed1selfpres-dog_preference_gen1_seed2selfpres-panda_preference_gen1_seed0selfpres-dog_preference_gen2_seed0selfpres-dog_preference_gen2_seed2llama3_preferencetiny-dummy-qwen2-lmsys-arena-human-preference-55k-ff1e62c0-c03a-4d60-b70b-dccbe4d85aa1TinyLlama-1.1B-Chat-v1.0-lmsys-arena-human-preference-55k-6a35aee5-d0db-4241-bc70-b71f98405ebforpo_run_yash_beta_0.1_preference_data_v8_for_orpo_thirds_dataqwen_preferenceorpo_run_yash_beta_0.3_preference_data_v8_for_orpo_v2orpo_run_yash_lora_40_preference_data_v8_for_orpoorpo_run_yash_lora_36_preference_data_v8_for_orpoorpo_run_yash_beta_0.3_preference_data_v9_for_orpoorpo_run_yash_lora_44_preference_data_v9_for_orpoorpo_run_yash_lora_44_preference_data_v10_for_orpogemma_preferenceLlama-2-7b-oasst-preference-reward-model-adapterorpo_run_yash_lora_48_preference_data_v10_for_orpoorpo_run_yash_defog-sqlcoder-8b-dare-ties_preference_data_v11_cleaned_filteredorpo_run_yash_defog-sqlcoder-8b-slerp_preference_data_v11_cleaned_filtered
