排序: 最新 热门 引用
cs.AI 2606.19911

Multi-Agent Transactive Memory

提出多智能体交易记忆(MATM)框架,通过共享轨迹提升异构智能体群体的任务表现,实验显示成功率提升8%,步骤减少0.59。

To Eun Kim, Xuhong He, Dishank Jain 等

2026-06-18 285
cs.CL 2606.19336

Learning User Simulators with Turing Rewards

提出基于图灵奖励的强化学习方法Turing-RL,用于训练人类用户模拟器,显著优于传统匹配方法。

Yingshan Susan Wang, Cedegao E. Zhang, Linlu Qiu 等

2026-06-18 206