1
Automating Deception: Scalable Multi-Turn LLM Jailbreaks
大模型安全新漏洞:多轮对话如何用“登门槛”心理绕过对齐机制
arXiv:2511.19517v3 Announce Type: replace-cross Abstract: Multi-turn conversational attacks, which leverage psychological principles like Foot-in-the-…