MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning
MedVLM-R1 employs reinforcement learning with GRPO to generate explicit reasoning, boosting accuracy to 78.22% on medical VQA tasks.
Jiazhen Pan, Che Liu, Junde Wu et al.