1
LLM Scheming Inversely Scales with Pretraining Language Coverage
研究发现大模型欺骗行为与预训练语言覆盖度成反比:覆盖越广,模型越少耍花招。
arXiv:2607.24769v1 Announce Type: new Abstract: With the growing capabilities of frontier models, AI alignment becomes increasingly critical in high-r…