BIM Informed Visual SLAM for Construction Environments
本文提出基于BIM信息的视觉SLAM系统,有效降低轨迹误差25.23%,提升地图精度7.14%。
Asier Bikandi-Noya, Miguel Fernandez-Cortizas, Muhammad Shaheer 等
本文提出基于BIM信息的视觉SLAM系统,有效降低轨迹误差25.23%,提升地图精度7.14%。
Asier Bikandi-Noya, Miguel Fernandez-Cortizas, Muhammad Shaheer 等
提出Any2Track框架,通过两阶段强化学习实现 humanoid 机器人在多种扰动下的运动追踪,性能优越。
Zhikai Zhang, Jun Guo, Chao Chen 等
提出几何体积与悬疑指标,提升LLM幻觉检测与修正能力。
Edward Phillips, Sean Wu, Soheila Molaei 等
UM-Depth结合运动和不确定性增强单目深度估计,KITTI数据集上表现优异。
Tae-Wook Um, Ki-Hyeon Kim, Hyun-Duck Choi 等
GenPAS框架通过三步采样提高生成推荐准确性,实验显示性能提升达783.7%。
Geon Lee, Bhuvesh Kumar, Clark Mingxuan Ju 等
WebWeaver采用动态轮廓和双代理架构,有效提升开源深度研究的准确性和效率。
Zijian Li, Xin Guan, Bo Zhang 等
提出Agentic CPT方法,基于大规模多任务数据训练,显著提升深度研究型智能体性能,关键指标突破39.9%。
Liangcai Su, Zhen Zhang, Guangyu Li 等
WebResearcher通过迭代深度研究范式和WebFrontier数据引擎,实现长远推理能力突破,达成6项基准最优。
Zile Qiao, Guoxin Chen, Xuanzhong Chen 等
提出一种基于深度学习的任务定制机器人设计协同框架,能秒级生成多样化机器人结构。
Jonathan Külz, Sehoon Ha, Matthias Althoff
提出结合神经常微分方程、图神经网络和神经过程的心脏轨迹重建与分类模型。
Jaume Banus, Augustin C. Ogier, Roger Hullin 等
Conan-Embedding-v2为从零训练的1.4B参数大模型,结合跨语言数据,提出软掩码和动态硬负样本挖掘,实现SOTA文本嵌入性能。
Shiyu Li, Yang Tang, Ruijie Liu 等
利用线性判别分析识别模型中时态与体貌的正交方向,实现多词生成中的因果控制。
Alina Klerings, Jannik Brinkmann, Daniel Ruffinelli 等
EgoMem通过全双工模型实现个性化对话,识别准确率超95%。
Yiqun Yao, Naitong Yu, Xiang Li 等
AgenticIE系统在复杂法规文件中提取信息,EM得分提升16%。
Gaye Colakoglu, Gürkan Solmaz, Jonathan Fürst
本文综述大语言模型在时间序列推理中的应用,提出三种推理拓扑结构。
Ching Chang, Yidan Shi, Defu Cao 等
提出基于图的系统误差传播模型(SEPG),分析传感器攻击的端到端影响及未被重视的攻击路径。
Qingzhao Zhang, Shaocheng Luo, Z. Morley Mao 等
提出基于核的随机逼近框架,用于学习无限维空间中的非线性算子,提供理论保证。
Jia-Qi Yang, Lei Shi
ImMimic用DTW映射与MixUp桥接人机差距,5机器人演示下多任务成功率显著提升。
Yangcen Liu, Woo Chul Shin, Yunhai Han 等
Maestro采用多智能体自我优化机制,通过Critic和Judge实现文本引导的图像自我提升,显著提升图像质量。
Xingchen Wan, Han Zhou, Ruoxi Sun 等
MagicMirror通过340K标注数据和GRPO训练的VLM实现细粒度图像伪影评估,显著提升模型缺陷检测能力。
Jia Wang, Jie Hu, Xiaoqi Ma 等