cs.CL 2603.10165

OpenClaw-RL: Train Any Agent Simply by Talking

OpenClaw-RL employs an asynchronous architecture to leverage next-state signals for online personalized and general agent training, integrating evaluative and directive signals.

Yinjie Wang, Xuyang Chen, Xiaolong Jin et al.

2026-03-11 69 citations 46