Team Ai
Modelpublic

gevaertlab/diffusiongemma-radiology-vqa

sourceHugging Faceapache-2.0updated 3mo agoView on Hugging Face
3likes
Model Card

DiffusionGemma finetunes for radiology VQA

This repository contains LoRA finetunes of DiffusionGemma (image-conditioned discrete-diffusion LLM) for radiology visual question answering, each paired with an autoregressive Gemma-4 finetune as a controlled baseline. It corresponds to the paper Discrete Diffusion Language Models for Interactive Radiology Report Drafting.

The dataset covers mixed modalities/anatomy (VQA-RAD, SLAKE, VQA-Med: X-ray/CT/MRI, head/chest/abdomen). Judge-best checkpoint per cell.

Code: https://github.com/mxvp/discretediffusionRRG

subfolderbackbonebase modeldatasetLLM-judge acc
diffusion-vqaraddiscrete-diffusiongoogle/diffusiongemma-26B-A4B-itVQA-RAD0.649
ar-vqaradautoregressivegoogle/gemma-4-26B-A4B-itVQA-RAD0.649
diffusion-slakediscrete-diffusiongoogle/diffusiongemma-26B-A4B-itSLAKE0.863
ar-slakeautoregressivegoogle/gemma-4-26B-A4B-itSLAKE0.817
diffusion-vqameddiscrete-diffusiongoogle/diffusiongemma-26B-A4B-itVQA-Med0.666
ar-vqamedautoregressivegoogle/gemma-4-26B-A4B-itVQA-Med0.631