On the Road with GPT-4V(ision): Early Explorations of Visual-Language Model on Autonomous Driving
GPT-4V-based VLM demonstrates superior scene understanding and causal reasoning in autonomous driving, outperforming existing systems by 10-15% in key metrics.
Licheng Wen, Xuemeng Yang, Daocheng Fu et al.