STAR-R1: Spatial TrAnsformation Reasoning by Reinforcing Multimodal LLMs
STAR-R1 enhances spatial reasoning in multimodal LLMs using reinforcement learning, achieving a 23% improvement in cross-view scenarios.
Zongzhao Li, Zongyang Ma, Mingze Li et al.