GeoDistill-Refine: Silhouette-First Geometry Distillation for Annotation-Free Spacecraft Segmentation
GeoDistill-Refine采用多提示融合和签名距离场,提升空间目标无标注分割性能,IoU提升4.56%、Boundary F1提升13.80%。
Yonglong Zhang, Zongwu Xie, Yang Liu
GeoDistill-Refine采用多提示融合和签名距离场,提升空间目标无标注分割性能,IoU提升4.56%、Boundary F1提升13.80%。
Yonglong Zhang, Zongwu Xie, Yang Liu
DynaCrys:通过动态空间群扩散生成晶体,提升新颖晶体发现率。
Zhuotao Jin, Xiaoyun Wang, Nicholas Brawand 等
FinRank通过手工标注硬负样本,提升金融文件问答的证据识别能力,基准涵盖1185条问答记录。
Sasan Mansouri, Daniel Saad, Mark Wahrenburg 等
本研究通过深层探测与剪枝技术分析驾驶视觉-语言-动作模型中的规划令牌,发现早期语义意图可线性解码,层剪可提升1.33倍速度。
Harisankar Babu, Benjamin Coors, Christopher Lang 等
引入量子相位状态,复杂模型训练速度提升三倍,验证在字节级文本任务中表现优异。
Ahmed Nebli, Hadi Saadatdoorabi, Christopher Keibel 等
WNM-3D以3D场景令牌增强闭环VLN,但论文节选未披露GN-Bench具体分数。
Yuehao Huang, Yunzi Wu, Xiaotao Zhang 等
CANIS通过图像-语义桥接生成辅助,实现类别无关的3D对象语义化标准化,提升分类和分割性能。
Kendong Liu, Yuxin Yao, Junhui Hou
Momba通过网络架构改进(特征归一化、权重归一化、分布式回报模型)提升多目标强化学习性能。
Adam Štafa, Santeri Heiskanen, Petr Novotný 等
Modular TTT将测试时训练(TTT)作为可组合模块,通过图结构化设计优化性能。
Bohao Tang, Zhen Qin, Yuqi Pan 等
研究量子测量中信息损失的“读出阶数定律”,揭示不同测量限制下信息的几何分布。
Marwan Ait Haddou
提出MemWM,通过世界记忆库提升文本世界模型的状态保真度,SSF提升达206.3%。
Yujun Wang, Tao Zhang, Jinhe Bi 等
提出PILOT框架,通过表示推导机制解耦意图与轨迹,提升WAMs性能。
Xiangkai Ma, Yue Ma, Junjie Wang 等
GPTKB 2.0通过上下文引导的消歧构建了3850万三元组的知识库,支持可追溯的实体消歧。
Yujia Hu, Tuan-Phong Nguyen, Simon Razniewski
DCMPC-Net以跨模态提示补偿提升多天气图像复原,但文中未提供具体数值。
Wanshu Fan, Yunzhe Zhang, Yue Shen 等
提出MMAG基准,涵盖4,000个多控场景音频,评估多能力,揭示模型性能权衡。
Zihao Zheng, Xuenan Xu, Jiahao Mei 等
SkillEval通过线性方向投影评估技能文档的四个可解释维度,关联下游任务表现。
Jiahui Han, Qinuo Li, Ziheng Peng 等
提出StateFlow,采用序列流水线并行,显著提升长序列模型训练效率,达2.22×吞吐提升。
Wenxuan Zhao, Yingfa Chen, Xu Han 等
FYI浏览器插件结合AI与手动工具,提升数据驱动文章的事实核查效率。
Nguyen-Truong Thinh, Yuxuan Du, Phongsakon Mark Konrad 等
提出AgentChaos,通过HTTP层非侵入式注入LLM API故障,评估代理系统鲁棒性。
Gou Tan, Zhensu Sun, Jieke Shi 等
提出HSMLA结合多尺度线性注意与选择性softmax,提升高分辨率视觉变换器效率与精度。
Dong Liu, Yanxuan Yu, Renata Borovica-Gajic 等