Dual-Confidence Contrastive Decoding for Retrieval-Augmented Generation
提出DCCD结合文档和词级置信度,显著提升多文档问答中的冲突解析性能。
Raymond Li, Md Tawkat Islam Khondaker, Amirhossein Abaskohi 等
提出DCCD结合文档和词级置信度,显著提升多文档问答中的冲突解析性能。
Raymond Li, Md Tawkat Islam Khondaker, Amirhossein Abaskohi 等
Active-GRPO结合主动模仿与自我提升,显著提升分子优化的SR×Sim,从0.0959提升至0.1773。
Xuefeng Liu, Mingxuan Cao, Qinan Huang 等
PlanRAG通过逻辑查询树解决探索性推理问题,提升准确率。
Ganlin Xu, Linghao Zhang, Zhitao Yin 等
HOMER利用层级记忆结构和主动推理,有效理解长视频,提升性能达+10.8分。
Yixin Ji, Fanghua Ye, Juntao Li 等
AMVL框架通过双向校准目标解决训练推理不匹配,提升BLINK基准测试平均分+10.83。
Shijie Li, Yilin Gao, Siyuan Yang 等
DriveVer是一种轻量级轨迹验证器,在NAVSIM基准上提升规划模型性能。
Chong He, Yuechen Luo, Fang Li 等
提出基于Vitality的图像到3D形状Diffusion Transformer压缩方法,模型尺寸缩减66%,保持几何保真。
Jaeah Lee, Hyunjin Kim, Jaewoong Cho 等
提出MEPA:基于多尺度表示对齐的混合专家模型,显著提升图像生成效率与质量。
Nuoyan Zhou, Zhijun Tu, Lei Yu 等
CORGI利用CDOG、CA-3DGS和DCGR实现单图高精度3D犬模型重建,无需3D标注。
Yuxiao Wu, Weile Li, Boyi Zhu 等
提出自适应扰动选择方法,通过任务相关音频变换提升对比解码效果,提升准确率至81.4%。
Aaron Isidore Grace, Zhouyuan Huo, Weiran Wang
提出ALEE框架,利用AMR生成跨语言的英语极小对,评估275+语种的嵌入模型性能。
Andrianos Michail, Stylianos Psychias, Michelle Wastl 等
PointSplat通过人本预测,直接从点集推断高效高质量的高斯原语,实现3D人体实时重建。
Yujie Guo, Yudong Jin, Lingteng Qiu 等
ERA提出基于熵引导的视觉Token剪枝,通过偏置校正解决注意力崩塌问题,显著提升多模态大模型推理效率。
Yuhao Wang, Mu Qiao, Haiwen Diao 等
提出一种用于RMSNorm变压器的符号置换坐标传输方法,恢复91.1%坐标。
John Sweeney
InstanceControl方法无需实例标注,实现复杂图像生成,提升精度和控制力。
Xiaoyu Liu, Huan Wang, Fan Li 等
CoDex框架在无示范下实现复杂灵巧功能操作,平均成功率达73%。
Bowen Jiang, William Painter Reger, Roberto Martin-Martin
MemLearner通过学习查询机制增强视频世界模型的记忆能力,有效应对遮挡和动态场景。
Jiwen Yu, Jianxiong Gao, Jianhong Bai 等
提出WorldRoamBench,基于逐帧动作、视觉漂移、物理交互和记忆的长时程稳定性评估,涵盖600+场景。
Ting-Bing Xu, Jiacheng Sui, Zhe Gao 等
ECHO通过选择性记忆在Agentic RL中实现43.4%准确率,超越GRPO和SUPO。
Zijun Xie, Binbin Zheng, Enlei Gong 等
DualBrep通过双场连续表示,将B-rep几何与拓扑统一编码,支持端到端深度学习。
Yilin Liu, Pradeep Jayaraman, Chinthala Reddy 等