cs.RO 2602.18224

SimVLA: A Simple VLA Baseline for Robotic Manipulation

SimVLA simplifies Vision-Language-Action models, achieving 98.6% success on LIBERO benchmarks with only 0.5B parameters, outperforming multi-billion models.

Yuankai Luo, Woping Chen, Tong Liang et al.

2026-02-20 33
cs.RO 2602.08602

Mimic Intent, Not Just Trajectories

MINT uses multi-scale spectral decomposition to disentangle behavior intent from execution details, improving transfer and generalization in imitation learning.

Renming Huang, Chendong Zeng, Wenjing Tang et al.

2026-02-09 40