cs.CV 1809.01337

Localizing Moments in Video with Temporal Language

Proposed MLLC model uses latent context variables to improve video moment localization, validated on TEMPO dataset, outperforming prior methods.

Lisa Anne Hendricks, Oliver Wang, Eli Shechtman et al.

2018-09-05 34
cs.CV 1808.01338

Detailed Human Avatars from Monocular Video

A monocular video-based human avatar reconstruction method using SMPL model refinement, capturing facial, clothing, and fine details with 89.64% user preference.

Thiemo Alldieck, Marcus Magnor, Weipeng Xu et al.

2018-08-04 34
cs.CV 1807.10174

Superpixel Sampling Networks

Proposes a differentiable superpixel sampling network (SSN) combining deep features and soft clustering, outperforming traditional methods on benchmarks.

Varun Jampani, Deqing Sun, Ming-Yu Liu et al.

2018-07-26 296 citations 41
cs.CV 1806.07011

VirtualHome: Simulating Household Activities via Programs

Proposes VirtualHome, a simulation system that models household activities via programs, using deep learning to convert natural language and videos into executable task sequences, advancing robot task understanding.

Xavier Puig, Kevin Ra, Marko Boben et al.

2018-06-19 56
cs.CV 1806.03589

Free-Form Image Inpainting with Gated Convolution

Proposed a generative image inpainting system using gated convolution, achieving superior performance on Places2 and CelebA-HQ datasets.

Jiahui Yu, Zhe Lin, Jimei Yang et al.

2018-06-10 39
cs.CV 1805.09501

AutoAugment: Learning Augmentation Policies from Data

AutoAugment uses reinforcement learning to automatically discover image augmentation policies, reducing error rates to 1.5% on CIFAR-10 and achieving 83.5% Top-1 accuracy on ImageNet.

Ekin D. Cubuk, Barret Zoph, Dandelion Mane et al.

2018-05-24 42