1
A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation
大模型红队评估新框架,聚焦忠实度检验,为高风险场景部署提供可靠性参考,安全团队值得关注。
arXiv:2606.25476v1 Announce Type: cross Abstract: Large language models (LLMs) have demonstrated remarkable performance across natural language proces…