Model-based reinforcement learning (MBRL) achieves strong sample efficiency by planning within learned latent dynamics, yet its performance degrades substant…
机构:KAIST
来源:arXiv 2610.02801 | AI4Papers 论文推荐平台