1
Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training
超越“可解性”视角,提出“任务可学习性”作为LLM强化学习后训练的静态先验,值得关注。
arXiv:2608.09217v1 Announce Type: cross Abstract: Reinforcement learning (RL) has become a central post-training paradigm for eliciting reasoning capa…