models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
deberta-preference-rewardgemma-2-2b-it-preference_dataset_mixture2_and_safe_pku-Preferencetulu-v2.5-13b-preference-mix-rmtulu-v2.5-70b-preference-mix-rmkaggle_human_preference_sample_v0Llama-3.2-1B-Instruct_Bradly-Terry-RM_Preference-700kgemma-2-2b-it-preference_dataset_mixture2_and_safe_pku-Preference-2048longformer-coherence-synthetic-preferencegemma-2-2b-it-preference_dataset_mixture2_and_safe_pku-Preferencehumanoid-preference-personalization-classifier-v1llm-preference-judge-deberta-v3-baseretriva-bert-preference-classifierpreference_iterative_hard-answer_generator-iter0gemma-2-2b-it-preference_700K-Preferencellm-preference-judge-deberta-v3-smallhelpfulness-preference-model-qwen-0.6B-mergedgemma-2-9b-it-preference_700K-PreferenceQwen2.5-Preference-Model-Schwinnmy-preference-modelqwen3-4b-merged-preference-classifier
