Dynamic-Programming-Guided Hierarchical BPE and Empirical Analysis of Vocabulary Pruning
提出DH-BPE结合最小Token分割与层级依赖,优化固定词表分配。
Kenny Shao
提出DH-BPE结合最小Token分割与层级依赖,优化固定词表分配。
Kenny Shao
ContextFlow用条件流匹配实现免微调示范学习,在LIBERO平均成功率达73.5%,超越ICRT 35个百分点。
Jian Ding, Xianjie Dai, Roei Herzig 等
MyBuddy在BuddyVQA基准上通过多模态链式推理实现了显著性能提升。
Hangyu Qin, Junbin Xiao, Shenglang Zhang 等
GAN-Blot: 提供46K合成WB图像,提升蛋白质带结构和视觉风格控制。
Hao-Chiang Shao, Fong-Yi Lin, Te-An Chien 等
提出了一种新的理论框架分析Masked Pretraining (MPT),解决了维度坍塌问题。
Qi Zhang, Runyu Zhou, Yifei Wang 等
提出无训练的大规模场景网格生成框架,结合局部连续性和全局一致性,提升几何与外观质量。
SangEun Lee, Wonseok Chae, Hoyoung Yoo 等
提出MovieGrid,通过空间网格分解长视频,提升多镜头生成的连贯性与多样性。
Jiawei Mao, Haoqin Tu, Hardy Chen 等
尺度响应曲线显示:ImageNet-1K模型越准确,越能在更小图像尺度下保持性能(r=-0.890)。
Anish Monsley Kirupakaran
EvoSafeHarness优化模型与领域特定的安全机制,将攻击成功率从45.6%降至10.0%。
Nanxi Li, Yingzi Ma, Yulong Cao 等
提出一种情感分布识别方法,通过联合学习情感概率矩阵提升识别准确率。
Tingyi Lin, Wen-Ren Yang, Kuanwei Chen
UniMate模型通过拓扑感知扩散变压器实现多骨架动画生成,优于现有方法。
Linzhan Mou, Jiahui Lei, Zhiyang Dou 等
WearableQA基准测试评估AI在真实可穿戴数据上的健康推理能力,性能从19.6%到72.9%。
Ji Soo Lee, Xilun Chen, Pierce Chuang 等
Diffusion TV通过改装的CRT电视提供扩散模型的互动体验,观众通过操控天线模拟去噪过程。
Sihwa Park
RegionFed通过梯度冲突分析实现个性化查询理解,达到92.27%准确率。
Quoc H. Nguyen, Ali Lafzi, Abhijeet Phatak 等
ROBORMBENCH揭示视觉语言模型在语义等价指令下的奖励不稳定性,包含2,390个轨迹和21,673个释义。
Wonje Jeung, Sangyeon Yoon, Hyesoo Hong 等
CrossDepth通过几何约束注意力提高多视角深度估计的准确性和一致性。
Samer Abualhanud, Max Mehltretter
提出IIns-GAN生成标注无线信号,提升模型训练效果。
Yuxiao Li, Keke Hu, Santiago Mazuelas 等
EDGE框架通过动态图合成数据,提升工具调用性能。
Dain Kim, Eungi Cho, Kyumin Kim 等
通过行为证据评估LLM解释的必要性和充分性,发现解释与模型行为的相关性有限。
Urja Pawar, Rajitha Ramanayake, Nabeel Kemal 等
Ref-GeNVS方法无需训练,生成镜面场景的新视角,显著提升反射一致性。
GeonU Kim, Shin Dong-Yeon, Tae-Hyun Oh