In-Context Learning of Linear Systems: Generalization Theory and Applications to Operator Learning
提出线性变换器在上下文中学习线性系统的理论保证,包括泛化界限和任务多样性条件。
Frank Cole, Yulong Lu, Wuzhe Xu 等
提出线性变换器在上下文中学习线性系统的理论保证,包括泛化界限和任务多样性条件。
Frank Cole, Yulong Lu, Wuzhe Xu 等
本研究对13种雷达点云提取算法在自主驾驶环境中的ICP里程计性能进行系统比较,发现K-强算法表现最佳。
Elliot Preston-Krebs, Daniil Lisus, Timothy D. Barfoot
提出基于蚁群算法的双目标路径规划,最大化任务奖励与机器人存活率,应用于博物馆信息采集。
Cory M. Simon, Jeffrey Richley, Lucas Overbey 等
本文提出了D-ATACOM方法,通过学习约束来处理长期安全性和不确定性,表现优于现有方法。
Jonas Günster, Puze Liu, Jan Peters 等
本研究分析百度ULTR数据集上两塔模型的日志策略偏差影响,发现偏差条件满足但未显著影响模型性能。
Morris de Haan, Philipp Hager
本文提出基于图神经网络的无不确定性高层空间概念生成方法,显著提升室内SLAM性能。
Jose Andres Millan-Romera, Muhammad Shaheer, Miguel Fernandez-Cortizas 等
Moshi结合Transformer和残差量化,支持160ms实时全双工对话,突破传统语音交互瓶颈。
Alexandre Défossez, Laurent Mazaré, Manu Orsini 等
OmniGen为统一图像生成模型,支持文本到图像、编辑等多任务,架构简洁,具知识迁移能力。
Shitao Xiao, Yueze Wang, Junjie Zhou 等
使用Audioset本体生成三元组,评估六种Transformer模型的音乐理解能力。
Yannis Vasilakis, Rachel Bittner, Johan Pauwels
Promptriever为首个可用指令提示的检索模型,基于MS MARCO的500k实例训练,显著提升指令遵循能力。
Orion Weller, Benjamin Van Durme, Dawn Lawrie 等
利用大规模代码模型实现无代码协作机器人编程,评估其在工业装配任务中的代码合成能力。
Chalamalasetti Kranti, Sherzod Hakimov, David Schlangen
KALE系统通过异构图增强艺术作品图像描述,CIDEr得分显著提升。
Yanbei Jiang, Krista A. Ehinger, Jey Han Lau
Playground v3通过深度融合大语言模型(Llama3-8B)实现文本与图像的高精度对齐,显著提升prompt遵循性。
Bingchen Liu, Ehsan Akhgari, Alexander Visheratin 等
TRC Bench评测19个LLM,系统梳理RAG六维可信性
Yujia Zhou, Wenbo Zhang, Jingying Shao 等
BNEM利用噪声能量匹配,结合引导式能量学习,提升采样效率与鲁棒性。
RuiKang OuYang, Bo Qiang, José Miguel Hernández-Lobato
提出多模态框架,整合运动、音频和外观特征,在ARGO1M数据集上实现最先进性能。
Cagri Gungor, Adriana Kovashka
提出LoCU框架,系统分析漫画理解中的视觉-语言任务与数据,强调数据稀缺与任务定义不足。
Emanuele Vivoli, Mohamed Ali Souibgui, Andrey Barsky 等
提出ManiDext,基于连续对应嵌入和残差引导扩散模型,实现手-物体动态操控合成。
Jiajun Zhang, Yuxiang Zhang, Liang An 等
DEAHES-O结合动态权重、EASGD与AdaHessian,在MNIST上接近故障可知方案并优于固定权重基线。
Yuesheng Xu, Arielle Carr
本研究验证稀疏神经网络在硬样本学习中可达或超越密集模型,尤其在有限数据和高难度样本下。
Qiao Xiao, Boqian Wu, Lu Yin 等