排序: 最新 热门 引用
cs.CV 2102.12092

Zero-Shot Text-to-Image Generation

基于transformer的零样本文本到图像生成,利用大规模数据训练,达到与领域专用模型竞争的效果。

Aditya Ramesh, Mikhail Pavlov, Gabriel Goh 等

2021-02-24 68
cs.CV 2102.02808

Multi-Stage Progressive Image Restoration

提出多阶段渐进式图像恢复网络(MPRNet),在十个数据集上实现显著性能提升。

Syed Waqas Zamir, Aditya Arora, Salman Khan 等

2021-02-05 28
cs.CV 2102.00719

Video Transformer Network

提出VTN,基于Transformer的视频识别框架,训练快、推理快,性能优异。

Daniel Neimark, Omri Bar, Maya Zohar 等

2021-02-01 32
cs.CV 2012.05901

Robust Consistent Video Depth Estimation

提出一种从单目视频中估计一致的深度图和相机姿态的新算法,超越Sintel基准。

Johannes Kopf, Xuejian Rong, Jia-Bin Huang

2020-12-11 33
cs.CV 2011.14141

AdaBins: Depth Estimation using Adaptive Bins

提出AdaBins,用自适应深度区间划分显著提升NYU和KITTI数据集的深度估计性能。

Shariq Farooq Bhat, Ibraheem Alhashim, Peter Wonka

2020-11-28 1247 引用 41