AVID: Learning Multi-Stage Tasks via Pixel-Level Translation of Human Videos
AVID learns multi-stage tasks via CycleGAN pixel-level translation of human videos, requiring only 20 minutes of demonstrations.
Laura Smith, Nikita Dhawan, Marvin Zhang et al.