排序: 最新 热门 引用
cs.CV 2104.14222

Privacy-Preserving Portrait Matting

提出P3M-10k数据集和P3M-Net模型,实现隐私保护肖像抠图,面向无脸识别场景。

Jizhizi Li, Sihan Ma, Jing Zhang 等

2021-04-29 33
cs.CV 2104.12756

InfographicVQA

提出InfographicVQA数据集,结合Transformer模型实现对信息图的多模态理解,评估表现较差。

Minesh Mathew, Viraj Bagal, Rubèn Pérez Tito 等

2021-04-27 54
cs.CV 2104.03916

Field Convolutions for Surface CNNs

提出了一种新的表面卷积运算器Field Convolution,提升了几何处理任务的准确率。

Thomas W. Mitchel, Vladimir G. Kim, Michael Kazhdan

2021-04-09 2
cs.CV 2104.00743

Towards General Purpose Vision Systems

GPV-1以共享视觉语言架构统一多任务,在COCO上VQA达62.5、CIDEr-D达1.023。

Tanmay Gupta, Amita Kamath, Aniruddha Kembhavi 等

2021-04-02 20