Benchmarking the Alignment of Data-Quality Metrics, Human Judgment and Land-Cover Segmentation Performance for Earth Observation
本研究系统评估地球观测数据的自动质量指标与人类感知及下游任务的偏差,揭示指标在合成数据中的局限。
Ümit Mert Çağlar, Alptekin Temizel
本研究系统评估地球观测数据的自动质量指标与人类感知及下游任务的偏差,揭示指标在合成数据中的局限。
Ümit Mert Çağlar, Alptekin Temizel
TAIS方法验证温度零下推测解码的安全性,48,072样本无安全偏差。
Sahil Kadadekar
边缘-云推测解码在低RTT下提升多租户能力,单请求延迟有限。
Yuan Lyu, Bharath Irukulapati, Jaya Prakash Champati
利用推理“tokens”模拟反应时间,分析视觉语言模型的搜索行为,发现其部分行为与人类相似。
Farahnaz Wick
构建通用的量子Schur变换实现第一/第二量子化态的高效转换,支持多统计类型。
Jack S. Baker, Gaurav Saxena, Thi Ha Kyaw
FLUX3D利用Diffusion-Aligned Structured Latents和稀疏结构感知扩散框架,实现高保真3D高斯点云生成,显著优于SOTA方法。
Haorui Ji, Weizhe Liu, Hongdong Li 等
提出多维评估方法结合技术指标与用户需求,针对六个AAC设计空间,提升AI辅助AAC系统的适应性和公平性。
Blade Frisch, Will Wade, Dylan Gaines 等
提出结构化认证框架,利用深度组合目标过滤特定转移,误差界为O(1/n)+δ,实现对部分转移的内部模型验证。
Yikai Lu, Yifei Wu, Xinyu Lu 等
本文分析 Andreas & Günther 的七个因果定义,揭示其实质等同性与逻辑矛盾,质疑差异制造的分类有效性。
Sander Beckers
Grad Detect利用层级梯度模式,单次推理中准确检测LLM幻觉,超越置信度基线。
Anand Kamat, Daniel Blake, Brent M. Werness
提出面向数据管理的系统性分析框架,评估12种代理记忆系统的性能,揭示架构与工作负载的匹配关系。
Wei Zhou, Xuanhe Zhou, Shaokun Han 等
引入惯性机制的Dirac-Frenkel动态,用于非线性参数化解的稳定性提升,提供误差界和数值鲁棒性。
Matteo Raviola, Benjamin Peherstorfer
利用无重复比例的扩展规模定律,量化模型中重复数据对性能的系统性损害,发现中间重复次数最为有害。
Jessica Chudnovsky, Joshua Kazdan, Noam Levi 等
SER方法使用语义证据奖励提升视频推理,V-STAR基准上mLGM提高3.0分。
Sheng Xia, Zhengqin Lai, Tianxiang Jiang 等
提出ReTVL,通过利用重试事件作为稀疏监督,捕捉局部错误与修正行为,显著优于基于单调进展的模型。
Xinyao Qin, Junjie Lu, Kaixin Wang 等
提出无平衡熵正则OT的样本复杂度分析,证明其几何稳定性和高概率界限。
Francisco Andrade, Gabriel Peyré, Clarice Poon
MemClaw通过治理共享内存解决多代理LLM系统中的四种失败模式,确保高效的知识管理。
Yanki Margalit, Nurit Cohen-Inger, Erni Avram 等
NatureBench基于NatureGym,评估AI编码代理在90个科学任务中的发现能力,SOTA仅超17.8%。
Yuru Wang, Lejun Cheng, Yuxin Zuo 等
PETRA利用能域分类与合成监督,提升石油工程检索性能,第一阶段nDCG由0.703升至0.763。
Kirill Dubovikov, Omar El Mansouri, Hachem Madmoun 等
TuringViT通过Turing线性注意、VISTA-Curation和动态分辨率预训练,实现高效、低成本的SOTA视觉变换器。
Qiman Wu, Hanlin Chen, Lyujie Chen 等