Uncertainty-Aware Variational Reward Factorization via Probabilistic Preference Bases for LLM Personalization
把个性化奖励拆解成可解释概率偏好,不确定性建模让LLM对齐更稳更准。
arXiv:2604.00997v2 Announce Type: replace Abstract: Reward factorization personalizes large language models (LLMs) by decomposing rewards into shared …