Accelerating Video Object Segmentation with Compressed Video
提出基于压缩视频的运动向量引导的半监督视频目标分割加速框架,最高实现3.5倍速度提升。
Kai Xu, Angela Yao
提出基于压缩视频的运动向量引导的半监督视频目标分割加速框架,最高实现3.5倍速度提升。
Kai Xu, Angela Yao
提出残差对数似然估计(RLE)提升人体姿态回归性能,MSCOCO提升12.4mAP。
Jiefeng Li, Siyuan Bian, Ailing Zeng 等
提出高阶合成模型与U-Net判别器,用纯合成数据训练的Real-ESRGAN显著提升真实图像超分效果。
Xintao Wang, Liangbin Xie, Chao Dong 等
提出基于网格的隐函数GAN方法,显著提升3D形状生成质量。
Moritz Ibing, Isaak Lim, Leif Kobbelt
提出基于工具变量的动态激励机制,改善非遵从行为以估计治疗效果。
Daniel Ngo, Logan Stapleton, Vasilis Syrgkanis 等
提出NCAD框架,结合表示学习与深度异常检测,适用于单/多变量时间序列,达成SOTA性能。
Chris U. Carmona, François-Xavier Aubet, Valentin Flunkert 等
TAPEX用合成SQL执行预训练,在四个表任务上刷新SOTA:WikiSQL 89.5%、WTQ 57.5%、SQA 74.5%、TabFact 84.2%。
Qian Liu, Bei Chen, Jiaqi Guo 等
提出无分布假设的校准预测(Conformal Prediction),保证90%覆盖率,适用多场景。
Anastasios N. Angelopoulos, Stephen Bates
通过控制特征提高知识对话的忠实性,使用GPT-2和T5模型,提升了对话的客观性和信息性。
Hannah Rashkin, David Reitter, Gaurav Singh Tomar 等
提出HDMapNet,基于摄像头和LiDAR的在线高精度地图构建框架,提升50%以上性能。
Qi Li, Yue Wang, Yilun Wang 等
提出SPOC算法用于文档主题估计,误差随字典规模对数增长。
Olga Klopp, Maxim Panov, Suzanne Sigalla 等
本研究提出Codex模型,基于GitHub代码微调,显著提升Python代码生成能力,解决28.8%的问题。
Mark Chen, Jerry Tworek, Heewoo Jun 等
本论文系统综述对话摘要的最新技术进展,涵盖多领域数据集、模型架构及未来方向。
Xiachong Feng, Xiaocheng Feng, Bing Qin
提出fMBN-E算法,通过集成多结构MBN模型实现无监督聚类的结构自动选择,性能优越且速度提升数百倍。
Xiao-Lei Zhang
提出变分扩散模型(VDM),实现图像密度估计的最优似然,优化噪声调度。
Diederik P. Kingma, Tim Salimans, Ben Poole 等
提出无分布预测带方法,保证多元函数时间序列的无偏差覆盖,应用于意大利天然气市场。
Jacopo Diquigiovanni, Matteo Fontana, Simone Vantini
ASDiv数据集通过多样化的词汇使用和问题类型,提升数学文字题求解器的评估准确性。
Shen-Yun Miao, Chao-Chun Liang, Keh-Yih Su
LaSynth用潜在执行轨迹合成C程序,在受限C上达55.2%,较无执行器方法高约20%。
Xinyun Chen, Dawn Song, Yuandong Tian
基于DNN手势识别的SwarmPaint实现人机多智能体轨迹与队形控制,误差约5.6cm。
Valerii Serpiva, Ekaterina Karmanova, Aleksey Fedoseev 等
Habitat 2.0平台结合ReplicaCAD、物理引擎与HAB任务,提升家用机器人长时任务能力。
Andrew Szot, Alex Clegg, Eric Undersander 等