models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
llama_8b-collusion-mo-sleeper_agent_dataset_deployment_in_prompt-sftAgentic-Data-1unified_agent_data_30k_filtered_unpolishedunified_agent_data_30k_filtered_polisheddata-agent-2b-normal-finaldata-agent-4b-normal-bestllama-2-7b-agent-20230118-datav2R2EGym-32B-Agent-Coder-Instruct-fim_midtrain_data_0108_212k_posttrain_r2egym_32768_8gpudata-agent-2b-curriculum-finaldata-agent-2b-curriculum-bestdata-agent-4b-normal-finalDataAgent-0.1data-agent-2b-normal-bestqwen-dataops-agentR2EGym-32B-Agent-Coder-Instruct-fim_midtrain_data_0108_212k_32768_8gpuqwen3-4b-agent-trajectory-loraALFWorld_data_combinationllm-lecture-2025_advanced_make_data_1_model_qwen3-4b-agent-trajectory-lorallm-lecture-2025_advanced_make_data_2_model_qwen3-4b-agent-trajectory-lorallm-lecture-2025_advanced_make_data_3_model_qwen3-4b-agent-trajectory-loraqwen3-4b-agent-Kumeichi-Data-lora-SFT-SQL-ALFWorld_rev.0.3qwen3-4b-agent-trajectory-DataMerge_rev.7_rev.6_lora-SFT-SQL-ALFWorld_rev.0.6
