Relational Semantic Reasoning on 3D Scene Graphs for Open World Interactive Object Search
SCOUT方法通过3D场景图进行开放世界交互式物体搜索,提升了效率。
Imen Mahdi, Matteo Cassinelli, Fabien Despinoy 等
SCOUT方法通过3D场景图进行开放世界交互式物体搜索,提升了效率。
Imen Mahdi, Matteo Cassinelli, Fabien Despinoy 等
研究揭示Transformer中的大规模激活和注意力陷阱现象,发现其是架构设计的产物。
Shangwen Sun, Alfredo Canziani, Yann LeCun 等
基于Mip-NeRF架构,结合自适应加权MSE,利用LWIR高光谱数据实现气体羽流3D重建与检测,训练样本减少50%。
Scout Jarman, Zigfried Hampel-Arias, Adra Carr 等
WebChain是最大规模的真实网页交互轨迹数据集,采用三层对齐机制,推动Web智能研究。
Sicheng Fan, Rui Wan, Yifei Leng 等
提出多语云语料库,涵盖孟加拉民族语言,结合系统田野采集与IPA转录,推动低资源语言数字化。
Mohammad Mamun Or Rashid
提出VideoHV-Agent,基于假设验证的多智能体框架,提升长视频理解的准确性和可解释性。
Zheng Wang, Haoran Chen, Haoxuan Qin 等
通过对比信号引导扩散重建,提升视觉表示的平衡性,显著提高D-Ability和P-Ability。
Boyu Han, Qianqian Xu, Shilong Bao 等
HiMAP-Travel通过分层多智能体规划解决长时间旅行中的预算和多样性约束问题,测试集FPR达52.65%。
The Viet Bui, Wenjun Li, Yong Liu
提出IF-RewardBench,构建多样化指令和偏好图,显著评估判别模型性能。
Bosi Wen, Yilin Niu, Cunxiang Wang 等
GOLF通过整合群组级自然语言反馈提升强化学习探索效率,样本效率提升2.2倍。
Lei Huang, Xiang Cheng, Chenxiao Zhao 等
Pointer-CAD通过指针机制解决B-rep模型几何选择问题,将分割误差降低至极低水平。
Dacheng Qi, Chenyu Wang, Jingwei Xu 等
利用Lw1+∞对单负弦子引力树幅进行递归构建,揭示其在特定配置下非零特性。
Alfredo Guevara, Alexandru Lupsasca, David Skinner 等
提出感知感知的时间最优路径规划框架,结合非线性动力学与视觉约束,提升无人机竞速表现。
Chao Qin, Jiaxu Xing, Rudolf Reiter 等
CodeTaste评估LLMs在代码重构中的表现,结合功能正确性和人类偏好,发现模型在自主识别重构方面存在差距。
Alex Thillen, Niels Mündler, Veselin Raychev 等
提出SORT,结合局部注意力和生成预训练,显著提升工业推荐模型性能。
Chunqi Wang, Bingchao Wu, Taotian Pang 等
利用演化博弈论和大模型模拟,研究人机混合社会中社会行为的共同演化。
The Anh Han, Joel Z. Leibo, Tom Lenaerts 等
提出DistriVoting结合高斯混合模型和SelfStepConf提升模型置信校准,显著优于SOTA。
Xizhong Yang, Haotian Zhang, Huiming Wang 等
提出VAS指标揭示多模冷启动中注意力偏差,AVAR框架提升7%性能。
Ruilin Luo, Chufan Shi, Yizhen Zhang 等
DSRM-HRL通过状态净化和分层决策实现推荐公平性,提升推荐效用和曝光公平性。
Yun Lu, Xiaoyu Shi, Hong Xie 等
采用DEVS形式,通过自然语言生成离散事件世界模型,确保长远一致性。
Zheyu Chen, Huiteng Zhuang, Zhuohuan Li 等