Attractor-Keyed Memory
吸引子键控存储结合选择与记忆访问,减少稀疏路由架构中的延迟与能耗。
Natalia G. Berloff
吸引子键控存储结合选择与记忆访问,减少稀疏路由架构中的延迟与能耗。
Natalia G. Berloff
通过Chain-of-Steps机制,视频生成模型在扩散去噪步骤中展现推理能力。
Ruisi Wang, Zhongang Cai, Fanyi Pu 等
MessyKitchens通过MOD算法实现了高精度的单目3D场景重建,显著提升了物体间接触的物理合理性。
Junaid Ahmed Ansari, Ran Ding, Fabio Pizzati 等
使用LoRA适配器和强化学习实现小型LLM的高效推理,显著降低响应长度。
Yelysei Bondarenko, Thomas Hehn, Rob Hesselink 等
SegviGen利用3D生成模型进行3D部件分割,仅需0.32%标注数据即可提升40%交互分割性能。
Lin Li, Haoran Feng, Zehuan Huang 等
ManiTwin通过单张图像生成100K高质量3D数字资产,支持大规模机器人操作数据生成。
Kaixuan Wang, Tianxing Chen, Jiawei Liu 等
BrickSim是一种物理模拟器,能实时模拟积木组件的装配和崩溃,准确率达100%。
Haowei Wen, Ruixuan Liu, Weiyi Piao 等
M^3方法结合多视图基础模型和单目高斯喷射SLAM,实现64.3% ATE RMSE降低。
Kerui Ren, Guanghao Li, Changjian Jiang 等
LEAFE框架通过反思性经验内化恢复能力,提升长远任务中的Pass@k表现。
Rui Ge, Yichao Fu, Yuyang Qian 等
提出一种在多阶段MLIR下持续保持维度类型注释的编译框架,实现数值表示与内存管理的联合决策。
Houston Haynes
PKINet-v2结合异向条形卷积与方形核,实现遥感目标检测的多尺度与几何适应,提升效率与精度。
Xinhao Cai, Liulei Li, Gensheng Pei 等
使用竞争性强化学习的PPO算法实现无人机拦截,捕获率超越基线。
Timothée Gavin, Simon Lacroix, Murat Bronz
MSRAMIE利用结构化多模态推理提升多指令图像编辑性能,达成15%以上改进。
Zhaoyuan Qiu, Ken Chen, Xiangwei Wang 等
EVPV以视觉前提可靠性门控PRM,在VisualProcessBench达67.46 Macro-F1,显著提升Best-of-8重排。
Junxin Wang, Dai Guan, Weijie Qiu 等
提出基于数据依赖和事后选择的等价性边界,利用e值实现模型的统一检验保证。
Stan Koobs, Nick W. Koning
提出SignNav任务及START模型,利用空间-时间Transformer实现室内大规模环境中的语义导航,成功率达80%。
Jian Sun, Yuming Huang, He Li 等
DualPrim通过正负超二次体实现紧凑的3D重建,提升结构表达能力。
Xiaoxu Meng, Zhongmin Chen, Bo Yang 等
Helium框架通过主动缓存和优化调度提升LLM工作流效率,实验显示最高加速1.56倍。
Noppanat Wadlom, Junyi Shen, Yao Lu
质疑CLIP模型的内模态失配假设,发现任务歧义而非失配是关键。
Jonas Herzog, Yue Wang
RAISE方法为VLA驾驶系统提供安全保障,提升系统信任度。
Gerhard Yu, Fuyuki Ishikawa, Oluwafemi Odu 等