GeoWorldAD: Geometry World Action Model for Autonomous Driving
GeoWorldAD基于3D几何和未来场景预测,提升自主驾驶路径规划性能。
Songyan Zhang, Jinyuan Tian, Hanbing Li 等
GeoWorldAD基于3D几何和未来场景预测,提升自主驾驶路径规划性能。
Songyan Zhang, Jinyuan Tian, Hanbing Li 等
提出GeAR框架,结合几何定位与外观还原,实现单幅古典绘画的3D重建。
Qinyu Zhang, Xinda Liu, Yunchen Li 等
RAMP通过屏蔽和对齐路径提高广告推荐准确性,尤其在缺乏个性化特征时。
Dairui Liu, Zhongyi Lu, Roger Zhe Li 等
研究表明多语言句子嵌入可替代翻译文本,用于LiRA可靠性审计,且恢复了因翻译失败被排除的响应。
Ummugul Bezirhan, Ji Yoon Jung, Matthias von Davier
提出多尺度Q-Net的Matryoshka Hypencoder,参数减少7倍,效果持平。
Majd Alkawaas, Sean MacAvaney
TimeLens2通过多模态大语言模型实现长视频多区域时间定位,采用基于Wasserstein距离的奖励机制,显著优于现有模型。
Yuhan Zhu, Changlian Ma, Xiangyu Zeng 等
EditCLEVR: 提供对象中心表示的组合忠实性基准,评估语义编辑后的表现。
Anuraag Gadehothur Karnam, Tarunesh Sathish
CoDID通过迭代模式发现和元优化协调机制实现了在隐藏相关性下的解缠学习,准确率提升7.8%。
Rong Hu, Ling Chen
本研究系统评估了基于LoRA的代码代理轨迹数据筛选方法,发现数据量对模型性能影响更大。
Yunze Han
引入干预中心的自动科研方法,通过独立轴搜索与外部验证实现材料机器学习决策的可验证性,提升外部转移成功率。
Jingjie Ning, Xiaochuan Li, Shanshan Zhong 等
提出ParaCAD,基于自回归模型直接生成支持原生参数曲面的B-Rep,提升几何精度。
Dafei Qin, Rui Xu, Zeyu Shen 等
WHALE模型结合Wukong和HSTU架构,在大规模推荐中提升性能。
Renqin Cai, Dawei Sun, Yuanjun Yao 等
提出Prim-Dijkstra路由的弱NP完全性,构建高度平衡的(2,2)保证算法HP-RCRST,显著优于现有方法。
Keren Zhu
提出PSDPO方法,在VideoPhy-2上物理合理性提升至2倍,同时保持VBench上的语义一致性。
Siwei Meng, Yawei Luo, Shu Zhang 等
提出跨分支冲突保护框架CCS,有效阻止面部身份被未授权编辑,提升保护强度。
Weiwei Tan, Junxian Li, Rui Wang 等
提出基于图注意网络的深度强化学习算法解决含随机需求与外包的车辆路径问题VRP-SDO。
Mohsen Dastpak, Fausto Errico, Ola Jabali
提出SPARK-VLN,通过逐词流式提取隐藏状态,提升动态社会视觉-语言导航的反应速度与安全性。
Tianshuai Hu, Yangyi Zhong, Zeying Gong 等
Scene-SAM3D在不需微调的情况下,提升多视角3D场景生成质量,Replica数据集上CD减少43.8%。
Yuqi Zhang, Yadan Luo, Xiangyu Sun 等
本研究提出区分客观正确性(OC)与自我判断(SJ),发现SJ方向在跨域迁移中表现优于OC,揭示语义模糊性。
Yi-Long Lu
MultiLoReFT通过低秩表示微调解耦多模态共享与特定信息,提升预测性能与可解释性。
Sana Tonekaboni, Viktoria Schuster, Caroline Uhler