Training Diffusion Policies via Prior-Mapping Co-Evolution
机器人扩散策略训练新思路,先验映射协同进化提升性能,ICML 2026 收录值得关注
arXiv:2512.02581v3 Announce Type: replace Abstract: Reinforcement learning (RL) faces a persistent tension: policies that are stable to optimize (e.g.…