排序: 最新 热门 引用
cs.CV 2505.10565

Depth Anything with Any Prior

提出Prior Depth Anything框架,结合稀疏测量和深度预测,生成高精度密集的度量深度图。

Zehan Wang, Siyu Chen, Lihe Yang 等

2025-05-16 35
cs.CV 2505.07818

DanceGRPO: Unleashing GRPO on Visual Generation

本文提出DanceGRPO,基于稳定的Group Relative Policy Optimization(GRPO)框架,有效提升视觉生成模型在多任务、多场景下的强化学习性能,实验中最高提升达181%。

Zeyue Xue, Jie Wu, Yu Gao 等

2025-05-13 362 引用 31
cs.CV 2505.07062

Seed1.5-VL Technical Report

Seed1.5-VL结合532M视觉编码器与20B参数Mixture-of-Experts实现多模态理解,达38项SOTA。

Dong Guo, Faming Wu, Feida Zhu 等

2025-05-12 40