ThoughtTrace: Understanding User Thoughts in Real-World LLM Interactions
ThoughtTrace通过收集用户自报思想,提升多轮人机交互理解与模型对齐,分析显示思想难以由模型推断,内容丰富。
Chuanyang Jin, Binze Li, Haopeng Xie 等
ThoughtTrace通过收集用户自报思想,提升多轮人机交互理解与模型对齐,分析显示思想难以由模型推断,内容丰富。
Chuanyang Jin, Binze Li, Haopeng Xie 等
CogOmniControl通过CogVLM和CogOmniDiT实现创意意图认知和视频生成,超越现有模型。
Hongji Yang, Songlian Li, Yucheng Zhou 等
提出StitchVM,将预训练的像素空间奖励模型迁移到噪声潜变量中,提升效率与鲁棒性。
Hyojun Go, Hyungjin Chung, Prune Truong 等
Quant.npu通过全静态量化框架提高移动NPU推理效率,减少推理延迟15.1%。
Jinghe Zhang, Daliang Xu, Chenghua Wang 等
MDCNS框架通过多源负采样提升序列推荐性能,实验表现优异。
Yuanzi Li, Lingjie Wang, Jingyu Zhao 等
CaptchaMind通过强化学习和显式推理监督实现82.9%成功率,超越现有方法。
Pengcheng Wang, Haoxiang Liu, Yang Dai 等
BrepForge通过线框组合与边界条件表面实例化实现B-rep生成,确保拓扑完整性与几何精度。
Jing Li, Yihang Fu, Falai Chen
VASA在开放即席分割中超越SAM3 Agent 14-25%。
Zilin Wang, Stella X. Yu
CompoSE通过部件控制实现3D形状的合成与编辑,显著优于现有方法。
Habib Slim, Shariq Farooq Bhat, Mohamed Elhoseiny 等
OmniISR通过中间监督和正则化统一集中和联邦学习,缩小22.60%性能差距。
Wei-Bin Kou, Guangxu Zhu, Ming Tang 等
CVaR变体在潘多拉盒子和先知不等式中应用,揭示风险尾部的限制与结构恢复。
Jingwei Ji
提出STRELGen,结合多智能体轨迹生成扩散模型与时空逻辑实现安全关键场景生成。
Lorenzo Bonin, Francesco Giacomarra, Luca Bortolussi 等
MementoGUI通过学习多模态记忆控制器提升长时序GUI代理性能,显著改善任务成功率。
Ziyun Zeng, Hang Hua, Bocheng Zou 等
提出语义-空间解耦Transformer,有效解决NVS中的表示歧义,提升渲染质量。
Yihang Wu, Yihang Sun, Shaofeng Zhang 等
StableHand通过质量感知流匹配框架从第一视角视频中估计双手运动,W-MPJPE降低20-25%。
Huajian Zeng, Chaohua Yao, Yuantai Zhang 等
SkillsVote通过生命周期管理,提升大规模开源Agent Skills的推荐与演化,实验中显著改善代码基任务表现。
Hongyi Liu, Haoyan Yang, Tao Jiang 等
EPIC通过偏好对齐索引构建技术,显著降低存储需求并提升个性化检索精度,节省4044倍内存。
Changmin Lee, Jaemin Kim, Taesik Gong
提出自我策略蒸馏(OPSD),无需外部教师,显著降低GPU内存消耗。
Fangming Cui, Sunan Li, Jiahong Li
提出TaskGround框架,实现全场景家庭推理,提升任务成功率达20%以上。
ZhiYuan Feng, Yu Deng, Ruichuan An 等
提出4DLidarOpen,结合4D FMCW激光雷达的点云和速度信息,提升动态场景理解。
Kane Qian, Xin Zhao, Yining Shi 等