AnchorWorld: Embodied Egocentric World Simulation with View-based Evolution Customization
AnchorWorld通过3D人体运动和视角锚点实现可定制的自我演化场景模拟。
Yu Li, Menghan Xia, Gongye Liu 等
AnchorWorld通过3D人体运动和视角锚点实现可定制的自我演化场景模拟。
Yu Li, Menghan Xia, Gongye Liu 等
MatMind模型在晶体材料科学中实现了统一的结构-活性推理,超越了专用模型。
Zhan'ao Yao, Boxuan Zhang, Jingyuan Shu 等
Rosetta Memory通过自适应内存优化跨LLM代理任务,实验显示性能提升。
Hao Yang, Shiqi Shen, Haoxuan Li 等
提出基于约束优势集的多模态长文问答检索方法,在VisDoMBench上达成66.99的最新SOTA,显著优于传统相似度排名。
Ambuj Mehrish, Sebatiano Vascon
TOAD利用测试时搜索优化轨迹,提升六个基础规划器性能,NAVSIM-v2达56.3 EPDMS。
Yihong Xu, Eloi Zablocki, Yuan Yin 等
提出SES,无需训练数据,通过方程残差优化,成功恢复代数与微分方程的符号解。
Sergei Garmaev, Vinay Sharma, Olga Fink
提出MalSkillBench,基于行为验证的恶意技能检测基准,涵盖3944个样本。
Wenbo Guo, Wei Zeng, Chengwei Liu 等
SlimSearcher通过自适应奖励门控提高训练效率,工具调用减少17%-58%。
Zequn Xie, Junjie Wang, Dan Yang 等
GuideCAD利用前缀嵌入结合视觉文本信息,轻量化生成3D CAD模型,参数少且效率高。
Minseong Kim, Jinyeong Park, Sungho Park 等
Task-Edit方法通过任务编辑生成多样化轨迹,提升3D视觉运动策略的泛化能力。
Jian-Jian Jiang, YiHan Yang, Lan Wei 等
SSRLive用静态与动态语义ID融合生成式建模,在线提升观看时长3.38%。
Teng Shi, Zhaoheng Li, Yuanhang Qu 等
FinEvolveBench以31个A股行业、177324篇新闻检验延迟反馈下的智能体自进化,通用记忆未稳定提升IC。
Zihao Deng, Yining Zhu, Leiming Wang 等
提出LIMMT,基于物理可行性、多样性和复杂度筛选运动数据,训练效果优于全量数据。
Yu Guan, Zekun Qi, Chenghuai Lin 等
本研究比较声明式与命令式AI代理在知识驱动工具使用中的表现,发现技能文件提升准确率。
M. Danish Lim, I. Danial Bin Sharudin, Wen Han Chen 等
提出FDM框架,利用WCCS优化ML配置以适应不同部署场景,验证多模型性能。
Tadiwa Vhito, Jakapan Suaboot, Warodom Werapun 等
通过RWSA分解实现技能生成,W2S框架提高行为重放一致性10.5%。
Yuyang Zhang, Xinyuan Han, Xudong Jiang 等
提出了一种跨视角融合框架,显著提高6-DoF抓取姿态估计的鲁棒性,在GraspNet-1Billion上表现优异。
Kangjian Zhu, Haobo Jiang, Jianjun Qian 等
提出CRAFT框架,通过双向反事实推理显著提升表格问答与事实验证性能。
Chenshuo Pan, Yu Zhao, Jie Zhang 等
AdMem框架通过整合语义、情节和程序记忆,提升LLM在长任务中的表现。
Runzhe Wang, Huilin Lu, Shengjie Liu 等
CaRE框架标准化MDLM重掩码策略评估,揭示温度和计算对排名影响。
Yash Shah, Abhijit Chakraborty, Vivek Gupta