Spoken Function Calling: A New Perspective on Spoken Language Understanding for Large Audio Language Models
提出Spoken Function Calling(SFC)新视角,通过结构化规则提升大音频语言模型的语义理解,超越传统封闭集SLU。
Yuezhang Peng, Yuxin Liu, Changfeng Gao 等
提出Spoken Function Calling(SFC)新视角,通过结构化规则提升大音频语言模型的语义理解,超越传统封闭集SLU。
Yuezhang Peng, Yuxin Liu, Changfeng Gao 等
引入基于大语言模型(LLMs)的符号回归(SR)框架,用于自动发现反应动力学模型,显著缩短模型识别迭代次数。
Roberto Aliaga Medina, Paulina Quintanilla, Antonio del Rio Chanona
采用VQ-VAE与U-Net的单次结构光深度重建,MAE为3.70mm,实时性能达26Hz。
Wayne Wonseok Rodgers, Xiangyi Le, Seonghoon Jang 等
本文引入IRT模型对192个大模型在8个安全基准上的表现进行分析,发现三大潜在能力,显著降低评估成本并支持模型审计。
Joshua Fonseca Rivera, Neil Shah, David Demitri Africa 等
BridgeVLA++结合点云投影、多视记忆与预训练VLM,实现高效、泛化强的3D机器人操控。
Peiyan Li, Yuze Zhu, Yixiang Chen 等
利用基础视觉模型实现跨物种动物姿态追踪,超越传统标注依赖。
Le Li, Daniela Ivanova, Nicolas Pugeault
边缘匹配不能保证因子化采样,模型泄漏问题依然存在。
Duong Bach, Hai Nguyen Hong, Cuong Do
引入变分界界限方法,分析高维高斯混合数据中连续自旋感知器的极限压力,提供上下界和固定点方程。
Francesco Camilli, Pierluigi Contucci, Federica Gerace 等
MemoryCPT通过端到端训练的记忆框架,结合QAD和QAR,显著提升长远对话中的成本-性能比,实验中QPC提升至0.138。
Songxin Lei, Kun Ouyang, Weilin Ruan 等
提出Observation-Calibrated Self-Distillation(OCSD),通过对比结构匹配的回放视图,改善大模型强化学习中的偏差问题,显著提升多任务性能。
Yi Yang, Cong Qin, Xiaodan Liu 等
提出TriQua框架,结合基础三元组与修饰符,实现事实评估的细粒度与上下文平衡。
Jin Liu, Steffen Thoma, Achim Rettinger
MAGIC框架结合图结构标签传播与几何校准,有效缓解SSCIL中的特征漂移与标签不可靠问题。
Yousef Abdi, Mohammad Asadpour, Yousef Seyfari
提出Masked Diffusion模型改善节拍追踪,显著降低不连贯输出。
Francesco Foscarin, Filip Korzeniowski, Richard Vogl
ABD方法在LiveCodeBench-v6上达到59.43%的准确率,优于Single9和HAC。
Ruitong Li, Binjie Guo, Aisheng Mo 等
基于ISMIE框架,Sun通过问卷、神经信号实验分析GenAI对现代信息搜索的影响,揭示偏好变化与认知负荷。
Shuoqi Sun
EuroExec基准显示前沿大模型在欧洲高管决策任务中表现远低于专家水平。
Pau Arnal, Khaled Denfir, Danylo Smahliuk 等
提出DiVers数据集,涵盖超110万音乐版本,增强在真实环境中的鲁棒性,显著提升音乐版本识别系统性能。
Simon Hachmeier, R. Oguz Araz, Dmitry Bogdanov 等
提出多目标排序模型,结合即时与延迟信号,采用Segment-Aware策略,提升Twitch直播推荐的DAU和ARPU,参数减少41.9%。
Xiaoyi Gu, Julia Tavares, Eder Santana 等
CommBench评估LLMs生成GPU通信代码的正确性与效率,GPT-5.5仅达30.7%的任务成功率。
Shuang Ma, Yuyi Li, Yihan Zhang 等
ToolArtist通过后训练的统一多模态模型,实现动态协调推理、工具调用与图像生成,显著优于固定流程方法。
Jiahao Zhao, Xiaomin Yu, Zhongxiang Sun 等