models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Wayra-Perplexity-Estimator-55M-TensorRTbugged-myelin-tensorrt-gptjTensorRT_Llama-3.1-Minitron-4B-Width-Basetensorrtllm_mixtral_dpo_engineMixtral-TensorRTdistilbert-base-uncased-sst2-onnx-int8-for-tensorrtTensorRT-LLM-engine-Mistral-7B-instruct-v0.2tinyllama-tensorrtmixtral_tensorrt_h100_tp2_w2_nvlinkphi2-tensorrtmixtral_tensorrt_a100_tp2_w2_paged_kvcachemixtral_tensorrt_a100_tp4_w4_all_stqwen-primeai-4bit-tensorrttensorrtMeta-Llama-3-8B-GPTQ-tensorrtairoboros-7b-tensorrtairoboros-2.2.1-y34b-tensorRT-uq-bs12mixtral_tensorrt_a100_tp2_w2mixtral_tensorrt_a100_tp2_w2_nvlinkairoboros-l2-70B-tensorRT-model-tp2mixtral_tensorrt_a100_tp2_w2_paged_fusedMLPgpt-j-6B-tensorrt-int8gpt2-tensorrtchatglm3_6b_32k_TensorRTReadylaya-multilingual-rknn-tensorrt
