1
Are Language Models Sensitive to Morally Irrelevant Distractors?
突发奇想的研究:LLM会不会被无关干扰带偏?揭示模型道德判断的隐含盲区
arXiv:2602.09416v2 Announce Type: replace Abstract: With the rapid uptake of large language models (LLMs) across high-stakes settings, it is becoming …