Beyond Monotonic Progress: Retry-Supervised Value Learning for Robot Imitation
ReTVL leverages sparse retry event supervision to capture local mistake-recovery dynamics, outperforming progress-based models in fine-grained value estimation.
Xinyao Qin, Junjie Lu, Kaixin Wang et al.