Conformal Risk-Averse Decision Making with Optimized Certainty Equivalent Risk Control
基于优化确定等价物(OCE)的风险规避决策,结合预测集提供高概率风险控制。
Amirmohammad Farzaneh, Osvaldo Simeone
基于优化确定等价物(OCE)的风险规避决策,结合预测集提供高概率风险控制。
Amirmohammad Farzaneh, Osvaldo Simeone
提出Gibbs加权框架,结合模型误差,提升多模型预测性能,适应不同场景。
Prasen R. Nuthanakaluva, Nava K. Gaddam
提出HubMixer,通过引入少量可学习潜在中心实现高效异构特征交互,参数节省显著。
Jie Zhou, Zixian Gong, Wenhao Li 等
PhyMamba框架通过物理调制实现电池健康预测,平均误差减少31.8%。
Sara Sameer, Yunyi Zhao, Wei Zhang 等
RA-OPD通过过滤不一致的轨迹来提高学生模型性能,在数学和代码基准上表现优异。
Siyuan Gan, Yuhan Li, Xiran Wang 等
提出AMUR框架,利用信息论引导选择性模态兴趣对齐,提升多模态推荐性能。
Wenze Ma, Chenyu Sun, Yanmin Zhu 等
StreamEMS通过自进化记忆机制提升视觉语言模型的视频流理解能力,在OVO-Bench上表现优异。
Yuxin Liu, Peiqin Zhuang, Yali Wang
SpikeOPD通过自生成前缀稳定蒸馏自回归尖峰语言模型,提升准确率2.9个点。
Enqiao Lu, Xingrui Yu, Yiwei Fu 等
提出快速权重注意机制,结合归一化第一阶更新,优化持续学习中的长序列建模。
Yifan Zhang, Steve Ta, Jasper Zhang 等
基于参数雅可比矩阵的半群扰动分析,提供网络输出稳定性新界限。
Halyun Jeong, Palle E. T. Jorgensen, Hyun-Kyoung Kwon 等
通过能量距离蒸馏方法,将多步扩散模型压缩为单步学生模型,提升天气预报效率。
Yiming Yang, Valentin Brekke, James Briant 等
LitCurate利用大语言模型构建低幔壳岩石状态方程数据库,包含1334条记录。
Abin Shakya, Wilson Samuels, Dominica Wilson 等
提出EMR-HyperNEAT,通过批处理实现多分辨率空间自适应拓扑发现,显著提升速度。
Romain Claret, Michael O'Neill, Paul Cotofrei 等
VGTok通过区域可分离性优化高分辨率目标检测,提升VisDrone数据集AP至48.38。
Khayrul Islam
提出MCR-Bench,基于多轮缺陷状态追踪的真实代码评审基准,涵盖五种语言,评估LLMs性能。
Dewu Zheng, Yanlin Wang, Xiwen Wang 等
提出弱模型引导的RLVR方法,通过外部前缀增强探索,提升推理覆盖率和多样性。
Xingyu Shen, Huishuai Zhang, Peng Li 等
本文比较三种融合范式(Merge、Mix RL、MOPD),在多领域RLVR中表现差异不大,但在单一任务上差距达8.6分,提供实用指导。
Siye Wu, Kai Yang, Yuchen Cai 等
本研究提出MILO框架,利用大规模重建模型(LRMs)从单幅图像重建3D人-物交互,超越现有方法的精度。
Agniv Chatterjee, Georgios Pavlakos
LeVJEPA采用无崩溃目标,简化架构,显著提升视频预训练效率,减少计算成本达20倍。
Lukas Kuhn, Lucas Maes, Giuseppe Serra 等
提出CorporateBench,基于时间演化知识库的企业级多任务问答基准,涵盖超23万文档。
Sil Hamilton, Albert Yu Sun, Oscar J. Romero 等