Value Leakage: An LLM's Answers Are Silently Shaped by Its Own Values
当大模型回答问题时,其内置价值观正悄然左右输出,揭示被忽视的“价值泄漏”现象
arXiv:2607.14345v1 Announce Type: new Abstract: People use language models for practical questions whose answers are difficult to verify. We show that…