cs.CV 2608.01169

Think in Sets for Streaming Video Token Compression

NovaCov uses set-wise selection with a recency-weighted reference bank, retaining 99.6% accuracy and reducing latency by 46% in streaming video token compression.

Moxu Duan, Jingwen Fu, Yuwang Wang

2026-08-02 51
cs.CV 2607.28211

Scaling Vision-Language Models Is Not Enough to Mitigate Bias

Large-scale evaluation of 194 VLMs shows model size correlates with overall accuracy (ρ=0.68), but not with robustness to multi-attribute bias; data quality is more critical.

Ioannis Sarridis, Ioannis Kompatsiaris, Symeon Papadopoulos

2026-07-30 39