models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
tiny-random-VisionEncoderDecoderModel-donuttiny-doc-qa-vision-encoder-decodergemma4-vision-encoderQwen3-VL-32B-vision-encoderMotif-Vision-EncoderInternVideo2Stage2-VisionEncoderLlama-3.2-11B-VisionEncodergemma3-vision-encoderRaon-VisionEncodertiny-random-VisionEncoderDecoderModel-vit-gpt2keural-vision-encoder-pocqwen3-vl-4b-vision_encoderqwen2.5-vl-7b-scienceqa-vision-encoder-onlySpydazWeb_Speech_Vision_EncoderDecoder_Multimodal_5b_ProjectSpydazWebAI_VisionEncoderDecoderModel_Mini548mimage-caption-generation-vision-encoder-decoder-modelSpydazWebAI_VisionEncoderDecoderModel_Mini3bqwen2.5-vl-7b-scienceqa-vision-encoder-projectorvision-encodergemma-3-12b-vision-encoder-onlykeural-vision-encoder-midEElayoutlmv3_jordyvl_rvl_cdip_100_examples_per_class_2023-08-19_text_vision_all_encoders_rampgemma-3-12b-vision-encoder-projector-onlyVisionEncoder
