1
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
世界模型当模拟器,用强化学习微调VLA策略,让机器人训练摆脱真实环境依赖。
arXiv:2602.13977v2 Announce Type: replace-cross Abstract: Reinforcement learning (RL) promises to unlock capabilities beyond imitation learning for Vi…