JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation
JanusVLN employs dual implicit neural memory to separate spatial geometry and semantic info, boosting vision-language navigation.
Shuang Zeng, Dekang Qi, Xinyuan Chang et al.