From Positionwise Confidence to Prefix Scheduling: Verifier Skipping in Speculative Decoding
提出验证器跳过策略,结合信号调度,在HumanEval上减少验证调用13.5%,保持相同pass@1。
Haoxuan Luo, Jameson Sandler, Ferdinando Fioretto
提出验证器跳过策略,结合信号调度,在HumanEval上减少验证调用13.5%,保持相同pass@1。
Haoxuan Luo, Jameson Sandler, Ferdinando Fioretto
提出会话交接的任务相对状态传递模型,利用预测等价性实现高效信息压缩。
Masahiro Kato, Taka Kato
基于期望自由能(EFE)的自主机器人路径规划,有效平衡信息采集与资源限制,提升火星探测地图精度。
Ajith Anil Meera, Pablo Lanillos, Wouter Kouw
Wyvern为多模态报告生成框架,结合信息检索与内容验证,提升87%的图像信息量。
Beatrice Alessandra Motetti, Emilien Guandalino, Daniele Jahier Pagliari 等
提出基于分布式时序差分学习的在线统计推断方法,验证其在回报分布函数估计中的渐近正态性和自助法一致性。
Yang Peng, Liangyu Zhang
采用多层扭绞纱结构调节电极重叠面积和纤维间距,实现压力敏感度达0.1331 MPa$^{-1}$,近场检测范围40-60mm。
Ishtia Zahir, Eslam Saleh, Maryam Rezayati 等
提出CoRun,通过位置不变性实现LLM推理的确定性与高效性,提升15-324%吞吐。
Shiju Zhao, Jiacheng Yang, Qihang Chen 等
提出DHD方法,测量多智能体消息的轨迹价值,发现错误但有用的消息在五个科学基准中普遍存在,超越答案正确性。
Chih-Hsuan Yang, Anjir Ahmed Chowdhury, Cheng-Hau Yang 等
ScienceFlow通过可恢复的可执行状态和ESTRA实现长远自主科研,提升搜索效率。
Mingming Zhao, Jiqian Dong, Kangping Xu 等
Mobius-v0通过知识与推理分离架构,在推理效率上实现近4倍提升,同时保持准确性。
Kai Chen, Jifeng Ding, Ning Ding 等
Pairton利用迭代重建框架在高能碰撞事件中重建短寿命粒子,实现了在全强子t¯t衰变上的最先进性能。
Andreas Hermansen, Chris Scheulen, Tobias Golling
SimpleOPD实现跨分词器长短上下文推理迁移,提升数学推理性能。
Haonan He, Haodi Lei, Yun Luo 等
提出AATC,通过变换编码实现KV缓存压缩,达5.8×无损效果。
Hannah Laus, Claudio Mayrink Verdun, Hao Wang 等
P2Skill通过提示技能蒸馏实现隐私保护,无需微调,提升隐私保留质量1.69倍。
Myunghoon Ryu, Geunpyo Park, Sungjoon Lee 等
提出HELIX,通过模型-工具协同进化实现递归自我提升,提升任务覆盖率4.0%及58.0%的验证覆盖。
Tianyu Fan, Chao Huang
提出CForce,通过一致性强制提升dLLMs的早期预测可靠性,显著改善高并行解码性能。
Yuji Ren, Chenkai Xu, Zhuocheng Gong 等
采用长时序分析,基于vLLM和SGLang的33,228个PR显示AI辅助开发显著提升产出与合作。
Jiada Li, Xuesong Ye, Olamide Olowoniyi
提出基于事件驱动Transformer的多仓库动态车辆路径优化框架,结合行为克隆与PPO训练,显著提升调度稳定性。
Faezeh Ardali, Gerald M. Knapp
Multiphase-Diff通过扩散模型生成高对比度多相物理系统样本,显著提高物理和分布一致性。
Yining Huang, Zhenyu Liang
本研究提出深度限制的连续学习框架,分析不同编码器-解码器区域的遗忘机制,关键在浅层编码器和深层解码器。
Amal Saqib, Tausifa Jan Saleem, Numan Saeed 等