1
Decoding-Level Taboo: A Diagnostic Stress Test for LLM Robustness
用解码级禁忌测试,揭示大模型在边界情境下的真实鲁棒性,为AI安全诊断提供新思路。
arXiv:2608.09900v1 Announce Type: new Abstract: Large language model evaluations typically focus on performance under nominal conditions, creating an …