Doubly Robust Kernel Statistics for Testing Distributional Treatment Effects
提出双重鲁棒核统计量用于检测分布因果效应,结合反事实均值嵌入与Permutation检验。
Jake Fawkes, Robert Hu, Robin J. Evans 等
提出双重鲁棒核统计量用于检测分布因果效应,结合反事实均值嵌入与Permutation检验。
Jake Fawkes, Robert Hu, Robin J. Evans 等
BEVBert引入空间感知的多模态地图预训练,显著提升VLN性能。
Dong An, Yuankai Qi, Yangguang Li 等
LMM-Planner利用少量示例实现 grounded 高级规划,达成竞争性表现。
Chan Hee Song, Jiaman Wu, Clayton Washington 等
提出无监督发现语言模型潜在知识的Contrast-Consistent Search方法,提升问答准确率4%。
Collin Burns, Haotian Ye, Dan Klein 等
提出层次多模态Transformer Hi-VT5,处理多页文档问答,达成85.95%的准确率。
Rubèn Tito, Dimosthenis Karatzas, Ernest Valveny
通过大规模弱监督训练680,000小时多语种语音模型Whisper2,零样本表现优异,逼近人类水平。
Alec Radford, Jong Wook Kim, Tao Xu 等
InternVideo结合生成与判别自监督学习,达成Kinetics-400 91.1%准确率,覆盖39个视频任务。
Yi Wang, Kunchang Li, Yizhuo Li 等
提出ASDK模型结合深核学习与特征选择,有效提升高维电路良率估算速度与准确性。
Shuo Yin, Guohao Dai, Wei W. Xing
通过知识图谱实现短期、情节和语义记忆系统,提升强化学习代理表现。
Taewoon Kim, Michael Cochez, Vincent François-Lavet 等
CoupAlign结合句子-掩码与词像素对齐,提升图像指示分割精度,oIoU提升约2%。
Zicheng Zhang, Yi Zhu, Jianzhuang Liu 等
提出CSCG模型,将空间视为高阶序列学习的潜在表达,解释海马体多样现象。
Rajkumar Vasudeva Raju, J. Swaroop Guntupalli, Guangyao Zhou 等
提出DIP算法,利用单目相机和人体姿态估计实现潜水员指向手势识别,定位水下目标。
Chelsey Edge, Junaed Sattar
提出了一种基于翻转图的新方法,减少矩阵乘法次数。
Manuel Kauers, Jakob Moosbauer
UniKGQA通过统一模型架构和参数学习,实现多跳知识图问答的检索与推理,显著提升性能。
Jinhao Jiang, Kun Zhou, Wayne Xin Zhao 等
ObjectStitch利用条件扩散模型实现无标注的生成式对象合成,提升图像真实感。
Yizhi Song, Zhifei Zhang, Zhe Lin 等
本研究对比经典、模块化和端到端学习的机器人语义导航方法,实地测试六个家庭,模块化方法成功率达90%。
Theophile Gervet, Soumith Chintala, Dhruv Batra 等
提出MuJoCo MPC中的预测采样算法,作为简单基线,表现出与复杂算法相当的效果。
Taylor Howell, Nimrod Gileadi, Saran Tunyasuvunakool 等
Super-CLEVR通过分离视觉复杂性等因素,提升VQA模型的域鲁棒性,P-NSVQA在三项指标上表现最佳。
Zhuowan Li, Xingrui Wang, Elias Stengel-Eskin 等
提出连续时间离散扩散模型,提升音乐和图像数据生成效果。
Haoran Sun, Lijun Yu, Bo Dai 等
提出基于任务驱动的混合模型降维方法,利用有限任务相关模式实现实时高性能操控。
Wanxin Jin, Michael Posa