ResearchCube: Multi-Dimensional Trade-off Exploration for Research Ideation
ResearchCube通过3D空间探索多维度研究权衡,提升研究创意生成。
Zijian Ding, Fenghai Li, Ziyi Wang 等
ResearchCube通过3D空间探索多维度研究权衡,提升研究创意生成。
Zijian Ding, Fenghai Li, Ziyi Wang 等
提出规模化问题规约库,结合AI编码代理实现100+问题类型和200+规约规则。
Xi-Wei Pan, Shi-Wen An, Jin-Guo Liu
提出TCER(微不足道偏差校正内源奖励),通过相对信息增益缓解开放式文本生成中的偏差问题。
Xinda Wang, Zhengxu Hou, Yangshijie Zhang 等
METRO利用大型语言模型从专家对话中自动提取策略,性能提升9%-10%。
Haofu Yang, Jiaji Liu, Chen Huang 等
WM-DAgger通过世界模型合成OOD恢复数据,五次演示下软包推送成功率达93.3%。
Anlan Yu, Zaishu Chen, Peili Song 等
系统评估10个多语教师模型,提出Polyglot Score指标,发现模型规模非关键,数据质量更重要。
Lester James V. Miranda, Ivan Vulić, Anna Korhonen
引入瓶颈令牌(BToks)解决多模态检索中的结构性问题,在MMEB-V2上取得59.0分。
Siyu Sun, Jing Ren, Zhaohe Liao 等
LaDA-Band使用离散掩码扩散模型实现声乐到伴奏生成,提升声学真实性和全局一致性。
Qi Wang, Zhexu Shen, Meng Chen 等
提出PLOVIS,通过Open-Vocabulary图像分割生成伪标签,有效缓解3D点云语义分割的数据不足。
Takahiko Furuya
WebForge通过四阶段自动化生成真实、可复现且可扩展的浏览器任务环境,解决了真实性、可复现性和规模化的三难困境。
Peng Yuan, Yuyang Yin, Yuxuan Cai 等
提出能量导向扩散桥(E-Bridge),通过短轨迹优化提升图像修复效率和质量。
Jinhui Hou, Zhiyu Zhu, Junhui Hou
提出CFMS框架,结合多模态大模型进行粗到细的表格推理,显著提升复杂表格理解能力。
Qixian Huang, Hongqiang Lin, Tong Fu 等
WARPED通过单目RGB视频生成手腕视角数据,训练机器人策略,减少数据收集时间5-8倍。
Harry Freeman, Chung Hee Kim, George Kantor
OmniUMI通过人类对齐的多模态交互实现物理基础的机器人学习,提升接触丰富操作性能。
Shaqi Luo, Yuanyuan Li, Youhao Hu 等
AffordGen通过3D生成模型生成多样化演示,提升机器人操控的泛化能力。
Jiawei Zhang, Kaizhe Hu, Yingqian Huang 等
CARE框架通过社区反应语气评估LLM与在线社区语言行为的对齐度。
Nuan Wen, Xuezhe Ma
BLUEmed结合多智能体辩论与混合检索增强,提升临床术语替换错误检测准确率至69.13%。
Saukun Thika You, Nguyen Anh Khoa Tran, Wesley K. Marizane 等
DeepShapeMatchingKit通过矢量化重构实现33倍加速,解决3D形状匹配瓶颈。
Yizheng Xie, Lennart Bastian, Congyue Deng 等
SMFormer结合基础模型和数据增强,实现自监督立体匹配的突破。
Yun Wang, Zhengjie Yang, Jiahao Zheng 等
FatigueFusion通过潜在空间融合生成疲劳驱动的运动,适用于多种合成任务。
Iliana Loi, Konstantinos Moustakas