1
Q-Learning with Fine-Grained Gap-Dependent Regret
Q-learning新理论突破,细粒度依赖遗憾界优化算法性能。
arXiv:2510.06647v2 Announce Type: replace-cross Abstract: We study fine-grained gap-dependent regret bounds for model-free reinforcement learning in e…
Q-learning新理论突破,细粒度依赖遗憾界优化算法性能。
arXiv:2510.06647v2 Announce Type: replace-cross Abstract: We study fine-grained gap-dependent regret bounds for model-free reinforcement learning in e…