1
When Preferences Fail to Become Incentives: A Utility-Behavior Gap in Large Language Models
揭秘大模型“口是心非”:偏好未化为激励,效用与行为存在隐性鸿沟
arXiv:2606.22974v1 Announce Type: new Abstract: Recent work on preference elicitation in large language models (LLMs) has demonstrated that, when give…